Commit History

Match AniGen SLat DAE head FP32 output contract
19cb312
verified

patdev commited on

Expand fixed-cardinality SLat DAE head profiles to 8192 tokens
7ef1052
verified

patdev commited on

Set L4 SLat DAE x64 head max profile to 4096 tokens
3d48584
verified

patdev commited on

Use unique external-data files per SLat DAE ONNX branch
4edaf55
verified

patdev commited on

Bound x64 SLat DAE head TensorRT profiles for L4 memory
9786194
verified

patdev commited on

Use static normalized_shape in SLat DAE ONNX LayerNorm export
50d8cca
verified

patdev commited on

Parse SLat DAE ONNX from file so TensorRT resolves external data
713bcf7
verified

patdev commited on

Add concise failure diagnostics around SLat DAE branch ONNX export
f6f2c6a
verified

patdev commited on

Add TensorRT builder for SLat DAE custom ONNX branches and heads
4bdf44a
verified

patdev commited on

Accept spconv list kernel_size in SLat DAE custom head export
b38d558
verified

patdev commited on

Use torch.library sparse custom ops and native wrapped spconv weights in SLat DAE heads
d609e9b
verified

patdev commited on

Use torch.library custom op for stable SLat DAE ONNX window attention export
2f38eb6
verified

patdev commited on

Add SLat DAE custom ONNX upsample and skeleton head exporter
30e62c3
verified

patdev commited on

Match AniGen FP32 input projections before FP16 SLat DAE blocks
043065a
verified

patdev commited on

Add full SLat DAE Swin branch ONNX exporter using custom sparse attention
27e9fbe
verified

patdev commited on

Expand AniGen skin TensorRT profile to 300k vertices
3254de2
verified

patdev commited on

Add AniGen SLat sparse-shell checkpoint extractor
5fb8c5d
verified

patdev commited on

Add AniGen skin-decoder TensorRT profile
ebdc7e7
verified

patdev commited on

Add AniGen skin decoder ONNX exporter
41ecabc
verified

patdev commited on

Add dynamic profiles for AniGen SLat TensorRT cores
7acb541
verified

patdev commited on

Add AniGen SLat transformer core ONNX exporter
226fe2e
verified

patdev commited on

Add TensorRT builder for AniGen ONNX components
2eb3593
verified

patdev commited on

Add full AniGen SS decoder ONNX exporter
f2ee801
verified

patdev commited on

Add full AniGen SS Flow ONNX exporter
2e605e2
verified

patdev commited on

Add static FLUX.2 Klein TensorRT L4 builder
67de8ac
verified

patdev commited on

Use streaming ONNX checker for multi-GB FLUX.2 export
1892c1c
verified

patdev commited on

Fix FLUX.2 external-data ONNX validation
e23670e
verified

patdev commited on

Split TensorRT builds per component to stay within 30GB RAM
4af75b4
verified

patdev commited on

Use torch.export ONNX opset 23 for FLUX.2 RMSNormalization
f17038f
verified

patdev commited on

Use NVIDIA ModelOpt AutoCast for TensorRT 11 mixed FP16
865bf5f
verified

patdev commited on

Export FLUX.2 transformer on L4 CUDA with static profiles
cc846b9
verified

patdev commited on

Tune TensorRT L4 builder optimization level
a5425e1
verified

patdev commited on

Support TensorRT 10 explicit-batch API
292b725
verified

patdev commited on

Add static FLUX.2 Klein transformer ONNX export pipeline
8aca026
verified

patdev commited on

Fix DSINE ONNX export on CUDA
0e0c466
verified

patdev commited on

Add L4 ONNX TensorRT hybrid runtime scaffold
ef79ec1
verified

patdev commited on