0pp0 commited on
Commit
5ca1abf
·
verified ·
1 Parent(s): 76cbf6c

Add mixed dense-Q4 variant AProjQ4-SExpQ8 (antirez/ds4#618)

Browse files

Attention projections Q4_K (imatrix-weighted), shared experts kept Q8. 2.8-3.2x decode in SSD streaming on 16GB Macs, +0.99% perplexity vs Q8, no reasoning-language drift. Full analysis: https://github.com/antirez/ds4/issues/618

.gitattributes CHANGED
@@ -47,3 +47,4 @@ DeepSeek-V4-Pro-Q4K-Layers-31-output.gguf filter=lfs diff=lfs merge=lfs -text
47
  DeepSeek-V4-Pro-Q4K-Layers00-30.gguf filter=lfs diff=lfs merge=lfs -text
48
  DeepSeek-V4-Flash-DSpark-support.gguf filter=lfs diff=lfs merge=lfs -text
49
  imatrix/DeepSeek-V4-Flash-chat-v2-routed-and-dense-ds4-220k.dat filter=lfs diff=lfs merge=lfs -text
 
 
47
  DeepSeek-V4-Pro-Q4K-Layers00-30.gguf filter=lfs diff=lfs merge=lfs -text
48
  DeepSeek-V4-Flash-DSpark-support.gguf filter=lfs diff=lfs merge=lfs -text
49
  imatrix/DeepSeek-V4-Flash-chat-v2-routed-and-dense-ds4-220k.dat filter=lfs diff=lfs merge=lfs -text
50
+ DeepSeek-V4-Flash-IQ2XXS-w2Q2K-AProjQ4-SExpQ8-OutQ8-chat-v2-imatrix.gguf filter=lfs diff=lfs merge=lfs -text
DeepSeek-V4-Flash-IQ2XXS-w2Q2K-AProjQ4-SExpQ8-OutQ8-chat-v2-imatrix.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2b57a0923d2263061bb59935bffc0d36997850238edfeea850b13491e131ac0a
3
+ size 84420584256