Gate TensorRT finite diagnostics behind CF_TRT_DIAGNOSTICS 39fa265 verified patdev commited on about 21 hours ago
Add SLat DAE full TensorRT finite-value diagnostics a5d6341 verified patdev commited on about 21 hours ago
Fix skeleton grouping dtype contract for TensorRT SLat DAE 119e89b verified patdev commited on about 22 hours ago
Use canonical x4 head coordinates for full SLat DAE TensorRT composition d66eec4 verified patdev commited on about 22 hours ago
Expand full SLat DAE runtime head profile to 8192 and log token counts 430c341 verified patdev commited on about 22 hours ago
Add opt-in checkpoint-free full SLat DAE custom TensorRT runtime 7c545b2 verified patdev commited on about 22 hours ago
Add checkpoint-free full SLat DAE TensorRT decoder runtime 5920265 verified patdev commited on about 23 hours ago
Add zero-copy TensorRT runner with data-dependent output allocation 5a6a851 verified patdev commited on about 23 hours ago
Use robust CPU SLat shell construction for positional buffers 2dd1f5a verified patdev commited on 2 days ago
Fix SLat TensorRT adapter to exact AniGen forward_stage API c538e36 verified patdev commited on 2 days ago
Support shell-only SLat TensorRT runtime with lazy native fallback 518214f verified patdev commited on 2 days ago
Add hybrid TensorRT adapter for AniGen SLat transformer core e652449 verified patdev commited on 2 days ago
Use validated TensorRT SS Flow decoder and skin decoder in AniGen runtime d7b8fd2 verified patdev commited on 2 days ago
Make FLUX TensorRT wrapper compatible with Accelerate CPU offload 655f9b8 verified patdev commited on 2 days ago
Lazy-load FLUX.2 TensorRT engine after prompt encoding 8c4e431 verified patdev commited on 2 days ago
Add Diffusers-compatible FLUX.2 TensorRT transformer wrapper 6f42354 verified patdev commited on 2 days ago
Stage dense conditioning before sparse AniGen model load 8c77f0a verified patdev commited on 2 days ago
Gate TRT by validation and prefer native DSINE fallback a772032 verified patdev commited on 2 days ago
Lazy-download ONNX only when TensorRT plan is unavailable f10fc0e verified patdev commited on 2 days ago
Select TensorRT or ORT CUDA independently per AniGen dense component 7b29899 verified patdev commited on 2 days ago
Add zero-copy TensorRT PyTorch runtime and AniGen hybrid loader c8091c9 verified patdev commited on 2 days ago