multimodalart HF Staff commited on
Commit
a97673a
·
verified ·
1 Parent(s): a13e9e4

Upload folder using huggingface_hub

Browse files
Files changed (1) hide show
  1. app.py +4 -2
app.py CHANGED
@@ -547,12 +547,14 @@ def generate(
547
 
548
  pred_latent = torch.cat(pred_latent_lst, dim=2)
549
 
550
- # Clean up caches and free VRAM before VAE decode
551
  transformer.clear_cache("pos")
552
  streaming_vae.clear_cache()
 
 
553
  torch.cuda.empty_cache()
554
 
555
- # Decode video - move pred_latent to CPU, then decode frame-by-frame
556
  pred_latent_cpu = pred_latent.cpu()
557
  del pred_latent
558
  torch.cuda.empty_cache()
 
547
 
548
  pred_latent = torch.cat(pred_latent_lst, dim=2)
549
 
550
+ # Free VRAM before VAE decode: move transformer and text encoder to CPU
551
  transformer.clear_cache("pos")
552
  streaming_vae.clear_cache()
553
+ transformer.to("cpu")
554
+ text_encoder.to("cpu")
555
  torch.cuda.empty_cache()
556
 
557
+ # Decode video
558
  pred_latent_cpu = pred_latent.cpu()
559
  del pred_latent
560
  torch.cuda.empty_cache()