Split TensorRT builds per component to stay within 30GB RAM 4af75b4 verified patdev commited on 3 days ago
Use NVIDIA ModelOpt AutoCast for TensorRT 11 mixed FP16 865bf5f verified patdev commited on 3 days ago