Commit History

Gate TensorRT finite diagnostics behind CF_TRT_DIAGNOSTICS
39fa265
verified

patdev commited on

Enable full SLat DAE TensorRT by default
c71f297
verified

patdev commited on

Add SLat DAE full TensorRT finite-value diagnostics
a5d6341
verified

patdev commited on

Fix skeleton grouping dtype contract for TensorRT SLat DAE
119e89b
verified

patdev commited on

Use canonical x4 head coordinates for full SLat DAE TensorRT composition
d66eec4
verified

patdev commited on

Expand full SLat DAE runtime head profile to 8192 and log token counts
430c341
verified

patdev commited on

Add opt-in checkpoint-free full SLat DAE custom TensorRT runtime
7c545b2
verified

patdev commited on

Add checkpoint-free full SLat DAE TensorRT decoder runtime
5920265
verified

patdev commited on

Add zero-copy TensorRT runner with data-dependent output allocation
5a6a851
verified

patdev commited on

Fix TensorRT skin decoder runtime dtype bindings
1a4cfbd
verified

patdev commited on

Fix dynamic TensorRT skin output allocation
e0333b0
verified

patdev commited on

Use robust CPU SLat shell construction for positional buffers
2dd1f5a
verified

patdev commited on

Fix SLat TensorRT adapter to exact AniGen forward_stage API
c538e36
verified

patdev commited on

Fix top-level runtime imports in HF Jobs
5518909
verified

patdev commited on

Activate shell-only SLat TensorRT production runtime
491169b
verified

patdev commited on

Support shell-only SLat TensorRT runtime with lazy native fallback
518214f
verified

patdev commited on

Add lightweight AniGen SLat sparse-shell loader
5c2a0c3
verified

patdev commited on

Add hybrid TensorRT adapter for AniGen SLat transformer core
e652449
verified

patdev commited on

Avoid downloading inactive SLat TensorRT plan
ec2e894
verified

patdev commited on

Use validated TensorRT SS Flow decoder and skin decoder in AniGen runtime
d7b8fd2
verified

patdev commited on

Add TensorRT wrappers for AniGen SS and skin models
8b84238
verified

patdev commited on

Expose BF16 facade around FP16 FLUX TensorRT plan
93487c6
verified

patdev commited on

Make FLUX TensorRT wrapper compatible with Accelerate CPU offload
655f9b8
verified

patdev commited on

Lazy-load FLUX.2 TensorRT engine after prompt encoding
8c4e431
verified

patdev commited on

Add Diffusers-compatible FLUX.2 TensorRT transformer wrapper
6f42354
verified

patdev commited on

Avoid downloading FLUX engine in AniGen 3D Jobs
7fc9106
verified

patdev commited on

Remove generated pycache from runtime repo
d6a924d
verified

patdev commited on

Remove generated pycache from runtime repo
d1f9591
verified

patdev commited on

Remove generated pycache from runtime repo
11e4233
verified

patdev commited on

Stage dense conditioning before sparse AniGen model load
8c77f0a
verified

patdev commited on

Gate TRT by validation and prefer native DSINE fallback
a772032
verified

patdev commited on

Lazy-download ONNX only when TensorRT plan is unavailable
f10fc0e
verified

patdev commited on

Select TensorRT or ORT CUDA independently per AniGen dense component
7b29899
verified

patdev commited on

Add zero-copy ORT CUDA fallback before PyTorch
9c30346
verified

patdev commited on

Add zero-copy TensorRT PyTorch runtime and AniGen hybrid loader
c8091c9
verified

patdev commited on

Add L4 ONNX TensorRT hybrid runtime scaffold
ef79ec1
verified

patdev commited on