File size: 2,622 Bytes
5e296ef
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
model_quantizer.workflow = "Quantize (FP8/INT8/NVFP4/MXFP8)"
model_quantizer.quant_format = "INT8"
model_quantizer.comfy_quant = true
model_quantizer.full_precision_matrix_mult = false
model_quantizer.scaling_mode = "row"
model_quantizer.block_size = 128
model_quantizer.include_input_scale = false
model_quantizer.convrot = true
model_quantizer.convrot_group_size = 256
model_quantizer.dynamic_convrot = false

model_quantizer.custom_full_precision_mm = false
model_quantizer.custom_convrot = false
model_quantizer.custom_convrot_group_size = 256

model_quantizer.simple = true
model_quantizer.skip_inefficient_layers = false
model_quantizer.full_matrix = false
model_quantizer.calib_samples = 1024
model_quantizer.manual_seed = -1
model_quantizer.optimizer = "original"
model_quantizer.num_iter = 200
model_quantizer.lr = 8.077300000003e-3
model_quantizer.lr_schedule = "adaptive"
model_quantizer.top_p = 0.02
model_quantizer.min_k = 16
model_quantizer.max_k = 64

model_quantizer.lr_gamma = 0.99
model_quantizer.lr_patience = 1
model_quantizer.lr_factor = 0.95
model_quantizer.lr_min = 1e-8
model_quantizer.lr_cooldown = 0
model_quantizer.lr_threshold = 0.0
model_quantizer.lr_adaptive_mode = "simple-reset"
model_quantizer.lr_shape_influence = 1.0
model_quantizer.lr_threshold_mode = "rel"
model_quantizer.early_stop_loss = 5e-9
model_quantizer.early_stop_lr = 1.01e-8
model_quantizer.early_stop_stall = 2000

model_quantizer.scale_optimization = "fixed"
model_quantizer.scale_refinement_rounds = 1

model_quantizer.exclude_layers = '^(first|last|tmlp|tproj|txtmlp|img_in|final_layer|time_embed|time_mod_proj)([.]|$)|^(txtfusion|text_fusion)[.]projector([.]|$)'
model_quantizer.layer_config_path = ""
model_quantizer.layer_config_fullmatch = false

model_quantizer.save_quant_metadata = true
model_quantizer.no_normalize_scales = false
model_quantizer.scaled_fp8_marker = 0
model_quantizer.verbose = "NORMAL"
model_quantizer.output_mode = "Compact (hide progress bars)"
model_quantizer.verbose_pinned = false
model_quantizer.low_memory = true
model_quantizer.allow_requantize = false

model_quantizer.preset = "INT8 ConvRot (Balanced / Native / Recommended)"
model_quantizer.model_preset = "krea2"
model_quantizer.filter.krea2 = true

model_quantizer.single_input_file = ""
model_quantizer.single_output_file = ""
model_quantizer.single_delete_original = false

model_quantizer.batch_input_folder = ""
model_quantizer.batch_output_folder = ""
model_quantizer.batch_extensions = ".safetensors"
model_quantizer.batch_recursive = true
model_quantizer.batch_overwrite = false
model_quantizer.batch_delete_original = false