Commit History

FP8 quantization: drop stale KD note, refresh PTQ metrics table
55c9d20

vpermilp commited on

Add FP8 vs fp16 evaluation results (1000 samples) to README
411962a

vpermilp commited on

Update README: document FP8 quantization, remove usage/versions
71f19ca

vpermilp commited on

Remove legacy pytorch_model.bin and modeling_gigaam.py from main
a7f346b

vpermilp commited on