Escarda-86M-Base-AutoRound-W4A16-RTN / quantization_config.json
INC4AI's picture
Upload quantized model Escarda-86M-Base-AutoRound-W4A16-RTN
4612b8f verified
Raw
History Blame Contribute Delete
8.13 kB
{
"quant_method": "auto-round",
"packing_format": "auto_round:auto_gptq",
"bits": 4,
"group_size": 128,
"sym": true,
"data_type": "int",
"iters": 0,
"model_free": true,
"autoround_version": "0.14.2",
"extra_config": {
"jepa.norm": {
"bits": 16,
"data_type": "float"
},
"lm_head": {
"bits": 16,
"data_type": "float"
},
"model.engram.gate.proj": {
"bits": 16,
"data_type": "float"
},
"model.engram.lookup.tables.0": {
"bits": 16,
"data_type": "float"
},
"model.engram.lookup.tables.1": {
"bits": 16,
"data_type": "float"
},
"model.hc_out_mix": {
"bits": 16,
"data_type": "float"
},
"model.hrm_refine.norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.0.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.0.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.0.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.0.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.0.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.1.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.1.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.1.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.1.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.1.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.10.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.10.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.10.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.10.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.10.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.11.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.11.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.11.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.11.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.11.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.12.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.12.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.12.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.12.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.12.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.13.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.13.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.13.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.13.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.13.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.14.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.14.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.14.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.14.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.14.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.15.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.15.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.15.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.15.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.15.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.2.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.2.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.2.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.2.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.2.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.3.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.3.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.3.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.3.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.3.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.4.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.4.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.4.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.4.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.4.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.5.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.5.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.5.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.5.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.5.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.6.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.6.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.6.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.6.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.6.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.7.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.7.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.7.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.7.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.7.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.8.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.8.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.8.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.8.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.8.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.9.attn.k_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.9.attn.q_a_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.9.attn.q_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.9.attn_norm": {
"bits": 16,
"data_type": "float"
},
"model.layers.9.ffn_norm": {
"bits": 16,
"data_type": "float"
},
"model.norm": {
"bits": 16,
"data_type": "float"
},
".*ffn\\.(gate_proj|up_proj|down_proj)$": {
"bits": 16,
"data_type": "float"
},
".*(jepa|hrm_refine)\\.(down|up)$|.*engram\\.compressor\\.proj$": {
"bits": 16,
"data_type": "float"
}
}
}