Commit History

optimizations for normal llama
ef5ecbc
verified

CompressedGemma commited on

Requires custom llama to use with this quant method
05e9fe6
verified

CompressedGemma commited on

Fold baked into standard Q2K codebook
0415704
verified

CompressedGemma commited on

Prototype: Produces NAN values, will not work in llama-server, do not download
145817b
verified

CompressedGemma commited on

Fix OOM on large tensors
92ec61a
verified

CompressedGemma commited on

DC cancellation buff
b57acee
verified

CompressedGemma commited on

I prefer Q2 honestly.. but leaving IQ1 staging in for posterity
3ba66cb
verified

CompressedGemma commited on

Super small quants
4856584
verified

CompressedGemma commited on

Lower RMSE, improve error shaping
bc08931
verified

CompressedGemma commited on

Delete embed_hessian.py
e422a7f
verified

CompressedGemma commited on

Delete dump_tensor.py
74aeb5c
verified

CompressedGemma commited on

Exponential speed-up
2e643f2
verified

CompressedGemma commited on

15% gain in model output
c4578eb
verified

CompressedGemma commited on

--analog-imatrix: Reduce error in output by 15%
c3e59d2
verified

CompressedGemma commited on

Replace Shor's with accelerated sieve
ae547e6
verified

CompressedGemma commited on

Update hexstate_quantize.c
a034f4d
verified

CompressedGemma commited on

Update hexstate_quantize.c
4384a45
verified

CompressedGemma commited on

Update hexstate_quantize.c
57f4b1d
verified

CompressedGemma commited on

Delete generate_imatrix.py
00ba2db
verified

CompressedGemma commited on

Upload hpc_forward_merged.c
e9294cc
verified

CompressedGemma commited on

Upload hpc_forward_merged.c
1581489
verified

CompressedGemma commited on