Commit History

Upload README.md with huggingface_hub
c745c24
verified

MichaelAnthony commited on

Keep vision/audio towers dense (fix image understanding)
9f56eae
verified

MichaelAnthony commited on

Update README for corrected quantization (527 layers, embeddings quantized)
5cf81eb
verified

MichaelAnthony commited on

Replace with corrected 4-bit affine quantization (single shard)
04ebf0e
verified

MichaelAnthony commited on

Fix: dense embeddings + correct .scales key naming (mlx-vlm load fix)
61468bd
verified

MichaelAnthony commited on

Quantize embeddings (fix Metal buffer cap)
cf2a8a7
verified

MichaelAnthony commited on

Fix quantized scales/biases tensor naming (module path, not .weight.scales)
b7fc8f0
verified

MichaelAnthony commited on

Add 4-bit affine MLX quantization (group 64)
0613fa4
verified

MichaelAnthony commited on

initial commit
a297f02
verified

MichaelAnthony commited on