aspect ratio: animate matches input; new-scene 4:3 default w/ ratio dropdown; drop parens from mode labels 819e798 verified multimodalart HF Staff commited on Jul 7
remove enhancer option; new frontal-face examples (CC0 from repo-to-space-example-inputs) dc63b6d verified multimodalart HF Staff commited on Jul 7
UI: distilled-model note in description, remove mode/prompt info hints, duration max 8s 2c9fa90 verified multimodalart HF Staff commited on Jul 7
cleanup: accurate native-pack comments; drop dead cudaMallocAsync mempool poke 91678dc verified multimodalart HF Staff commited on Jul 7
native pack (OffloadMode.NONE) + default native allocator + fraction=1.0 (fast, no offload latency) 3f9292d verified multimodalart HF Staff commited on Jul 7
wrap generation in inference_mode (streaming autograd fix); default enhancer off (device bug) adfa5ab verified multimodalart HF Staff commited on Jul 7
CPU offload: skip module-scope pack so shared checkpoint blob survives for streaming 8d00ff0 verified multimodalart HF Staff commited on Jul 7
fix #1: OffloadMode.CPU — stream transformer so resident drops, activation hoard fits ca01ab7 verified multimodalart HF Staff commited on Jul 7
fix #2: cudaMallocAsync + fraction=1.0 + mempool release threshold 8GB (stop pool accumulation) 0519b29 verified multimodalart HF Staff commited on Jul 7
native allocator (expandable_segments) + fraction=1.0: reuse freed blocks (cudaMallocAsync accumulated to OOM) 0a5200e verified multimodalart HF Staff commited on Jul 7
raise per-process memory fraction to 1.0 (ZeroGPU caps fork below MIG slice) 28633cd verified multimodalart HF Staff commited on Jul 7
Run transformer in bf16 (fp8 upcast-on-forward churn OOMs diffusion on MIG) 5ba1b66 verified multimodalart HF Staff commited on Jul 7
Free Gemma before diffusion (build-use-free) to fit VRAM 53b9c7d verified multimodalart HF Staff commited on Jul 7
ZeroGPU MIG: use cudaMallocAsync allocator (native caching allocator NVML query asserts) d52d846 verified multimodalart HF Staff commited on Jul 7
diag: log GPU size/mem/allocator backend in fork to diagnose NVML assert b04c6ae verified multimodalart HF Staff commited on Jul 7
ZeroGPU: expandable_segments to fix NVML_SUCCESS allocator assert on fp8 matmul 37aa164 verified multimodalart HF Staff commited on Jul 7
fp8 fuse: fall back to CPU SR when Triton has no real device ede5e57 verified multimodalart HF Staff commited on Jul 7
fp8 fuse on CPU at module scope (ZeroGPU parent has no real CUDA for Triton) 8b422c9 verified multimodalart HF Staff commited on Jul 7
app.py: LTX-2.3 distilled + in-space Gemma + source_phase overlap + xlarge 01cccc3 verified multimodalart HF Staff commited on Jul 7
Port to official upstream LTX-2.3 code (transformer/VAE/vocoder) + BFS source_phase 27ed70c verified multimodalart HF Staff commited on Jul 7
LTX-2.3: disable unsupported vocoder (silent video), keep joint AV denoising f7443f9 verified multimodalart HF Staff commited on Jul 7
LTX-2.3 VAE: drop 3 vestigial per-channel-stat buffers (fix meta-tensor crash) 7040066 verified multimodalart HF Staff commited on Jul 7
Switch base to LTX-2.3-22b (the checkpoint the Face-ID LoRA was trained on) 02d45e1 verified multimodalart HF Staff commited on Jul 7
Add MCP support: mcp_server=True + tool docstring e543abf verified multimodalart HF Staff commited on Jul 7
Fix LoRA quality: stochastic-rounding fp8 fuse on CPU (match GPU kernel) 99c488a verified multimodalart HF Staff commited on Jul 7
ZeroGPU: load/fuse on CPU so .to('cuda') gets hijacked in parent f8d08e7 verified multimodalart HF Staff commited on Jul 7
ZeroGPU: preload models at module scope (fix ephemeral-fork warmup) a2237f4 verified multimodalart HF Staff commited on Jul 7
Apply Face-ID LoRA correctly: overlap + source-phase reference conditioning (distilled.py) 0bb2a71 verified multimodalart HF Staff commited on Jul 7
Apply Face-ID LoRA correctly: overlap + source-phase reference conditioning (pipeline_utils.py) 70a5248 verified multimodalart HF Staff commited on Jul 7
Apply Face-ID LoRA correctly: overlap + source-phase reference conditioning (model.py) 556a493 verified multimodalart HF Staff commited on Jul 7
Apply Face-ID LoRA correctly: overlap + source-phase reference conditioning (reference_overlap.py) a3a75e7 verified multimodalart HF Staff commited on Jul 7
Apply Face-ID LoRA correctly: overlap + source-phase reference conditioning (modality.py) fa0b0a2 verified multimodalart HF Staff commited on Jul 7
Apply Face-ID LoRA correctly: overlap + source-phase reference conditioning (app: wire reference + ref_t2v prefix) efa52ec verified multimodalart HF Staff commited on Jul 7
Warmup once at startup, fix example images, add text-only scene mode f84f38c verified multimodalart HF Staff commited on Jul 7
Cache VAE/vocoder/upsampler builds across requests 2c9df60 verified multimodalart HF Staff commited on Jul 7
Warm-start + cache pipeline models to cut first-request latency 04b15f9 verified multimodalart HF Staff commited on Jul 7