File size: 2,901 Bytes
2051791
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
# AutoAWQ 0.2.5 two-device error break points
# b /home/justin/work/AutoAWQ/awq/models/base.py:170
# b /home/justin/work/AutoAWQ/awq/quantize/quantizer.py:61

# debug GPU memory measuring issue
# b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/eval/bench.py:242

# b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/adapter/autoawq.py:39
# b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/adapter/autoawq.py:46
# b /home/justin/miniconda3/envs/quant-eval/lib/python3.11/site-packages/transformers/modeling_utils.py:955, param_device == 'cpu'
# b /home/justin/miniconda3/envs/quant-eval/lib/python3.11/site-packages/transformers/modeling_utils.py:973, param_device == 'cpu'
# b /home/justin/work/transformers/modeling_utils.py:989
# b /home/justin/work/transformers/src/transformers/modeling_utils.py:4795
# b /home/justin/work/transformers/src/transformers/modeling_utils.py:4213
# b /home/justin/work/AutoAWQ/awq/models/base.py:338
# b /home/justin/work/accelerate/src/accelerate/big_modeling.py:420
# b /home/justin/work/accelerate/src/accelerate/hooks.py:579, module_name == 'model.layers.28.mlp.gate_proj'
# b /home/justin/work/accelerate/src/accelerate/hooks.py:579, module_name == 'model.layers.28'
# b /home/justin/work/accelerate/src/accelerate/hooks.py:288
# b /home/justin/work/accelerate/src/accelerate/hooks.py:308
# b /home/justin/work/accelerate/src/accelerate/hooks.py:327
# b /home/justin/miniconda3/envs/quant-eval/lib/python3.11/site-packages/transformers/modeling_utils.py:4194
# b /home/justin/miniconda3/envs/quant-eval/lib/python3.11/site-packages/transformers/quantizers/quantizer_bnb_4bit.py:190
# b /home/justin/work/transformers/src/transformers/modeling_utils.py:4194
# b /home/justin/work/hqq/hqq/utils/optimizer.py:21

# b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/misc/qweight.py:216
# b /home/justin/work/lm-quant-toolkit/src/cli.py:436
# b /home/justin/work/hqq/hqq/utils/optimizer.py:19
# b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/prep/sensitivity.py:206, i == 25
# b /home/justin/work/hqq/hqq/models/base.py:262
# b /home/justin/work/hqq/hqq/utils/optimizer.py:26
# b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/prep/sensitivity.py:395
# b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/prep/sensitivity.py:413
# b /home/justin/work/hqq/hqq/utils/optimizer.py:26
# b /home/justin/work/hqq/hqq/core/quantize.py:116
# b /home/justin/work/hqq/hqq/core/quantize.py:175
# b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/prep/sensitivity.py:24
# b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/eval/bench.py:256
# b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/eval/bench.py:270
# b /home/justin/work/hqq/hqq/utils/optimizer.py:157
b /home/justin/work/CLIP_benchmark/clip_benchmark/models/open_clip_hqq.py:13
b /home/justin/work/hqq/hqq/models/open_clip/base.py:63