{ "base_model": "Qwen/Qwen3.8-27B", "base_revision": "1d4bf0f2ff6012fd82039f2fa52739d0dd7c60c0", "target": "FP8", "quantizer": "GPTQModel 7.3.4", "quantizer_revision": "7df3d1e837cb5552512bf99b8729c334d0b2c010", "quantization_config": { "bits": 8, "group_size": -1, "desc_act": false, "lm_head": false, "method": "fp8", "quant_method": "fp8", "format": "float8_e4m3fn", "checkpoint_format": "float8_e4m3fn", "pack_dtype": "int32", "meta": { "fallback": { "strategy": "rtn", "threshold": "0.5%", "smooth": null }, "offload_to_disk": false, "offload_to_disk_path": null, "pack_impl": "cpu", "gc_mode": "interval", "wait_for_submodule_finalizers": false, "auto_forward_data_parallel": true, "dense_vram_strategy": "exclusive", "dense_vram_strategy_devices": null, "moe_vram_strategy": "exclusive", "moe_vram_strategy_devices": null }, "weight_scale_method": "row", "weight_scale_semantics": "inverse", "calibration_samples": 0, "calibration_sequence_length": null, "calibration_batch_size": null, "calibration_sort": null, "calibration_corpus_sha256": null }, "created_utc": "2026-08-16T21:31:30+00:00", "not_a_finetune": true }