cortiq-gemma4b / export_report.json
infosave's picture
Upload folder using huggingface_hub
1f30f2d verified
Raw
History Blame Contribute Delete
1.79 kB
{
"model_name": "google/gemma-4-12b-it",
"text_stack_path": "model.language_model.layers",
"num_hidden_layers": 48,
"intermediate_size": 3840,
"layer_types": [
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention"
],
"target_arch": {
"num_hidden_layers": 48,
"intermediate_size": 3840,
"actual_params_B": null,
"layers_to_remove": 0,
"width_to_cut": 11520,
"balance": 0.0,
"mode": "width_only"
},
"gguf_quant": "Q4_K_M",
"source_architectures": [
"Gemma4UnifiedForConditionalGeneration"
],
"calibration_cache_file": "/tmp/train_combined.json",
"calibration_sftp_path": "/var/www/html/models/train_combined.json"
}