Commit History

Split TensorRT builds per component to stay within 30GB RAM
4af75b4
verified

patdev commited on

Use NVIDIA ModelOpt AutoCast for TensorRT 11 mixed FP16
865bf5f
verified

patdev commited on

Tune TensorRT L4 builder optimization level
a5425e1
verified

patdev commited on

Support TensorRT 10 explicit-batch API
292b725
verified

patdev commited on

Add L4 ONNX TensorRT hybrid runtime scaffold
ef79ec1
verified

patdev commited on