multimodalart HF Staff commited on
Commit
7dfbc2f
·
verified ·
1 Parent(s): d8810f7

Upload app.py with huggingface_hub

Browse files
Files changed (1) hide show
  1. app.py +2 -1
app.py CHANGED
@@ -57,7 +57,8 @@ model_kwargs = dict(getattr(config, "model_kwargs", {}) or {})
57
  efficient_deployment = model_kwargs.pop("efficient_deployment", None) or {}
58
  # Disable FP8 quantization, lightvae, and custom kernels
59
  efficient_deployment = {}
60
- model_kwargs["efficient_deployment"] = efficient_deployment
 
61
 
62
  # Calculate sparse attention sparsity schedule
63
  num_frame_per_block = getattr(config, "num_frame_per_block", 1)
 
57
  efficient_deployment = model_kwargs.pop("efficient_deployment", None) or {}
58
  # Disable FP8 quantization, lightvae, and custom kernels
59
  efficient_deployment = {}
60
+ # Remove efficient_deployment from model_kwargs to avoid duplicate kwarg
61
+ model_kwargs.pop("efficient_deployment", None)
62
 
63
  # Calculate sparse attention sparsity schedule
64
  num_frame_per_block = getattr(config, "num_frame_per_block", 1)