File size: 2,715 Bytes
f1eb922
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
default_stage:
  default_modifiers:
    QuantizationModifier:
      targets: [model.layers.0.feed_forward.w1, model.layers.0.feed_forward.w2, model.layers.0.feed_forward.w3,
        model.layers.1.feed_forward.w1, model.layers.1.feed_forward.w2, model.layers.1.feed_forward.w3,
        model.layers.10.feed_forward.w1, model.layers.10.feed_forward.w2, model.layers.10.feed_forward.w3,
        model.layers.10.self_attn.k_proj, model.layers.10.self_attn.out_proj, model.layers.10.self_attn.q_proj,
        model.layers.10.self_attn.v_proj, model.layers.11.feed_forward.w1, model.layers.11.feed_forward.w2,
        model.layers.11.feed_forward.w3, model.layers.12.feed_forward.w1, model.layers.12.feed_forward.w2,
        model.layers.12.feed_forward.w3, model.layers.12.self_attn.k_proj, model.layers.12.self_attn.out_proj,
        model.layers.12.self_attn.q_proj, model.layers.12.self_attn.v_proj, model.layers.13.feed_forward.w1,
        model.layers.13.feed_forward.w2, model.layers.13.feed_forward.w3, model.layers.14.feed_forward.w1,
        model.layers.14.feed_forward.w2, model.layers.14.feed_forward.w3, model.layers.14.self_attn.k_proj,
        model.layers.14.self_attn.out_proj, model.layers.14.self_attn.q_proj, model.layers.14.self_attn.v_proj,
        model.layers.15.feed_forward.w1, model.layers.15.feed_forward.w2, model.layers.15.feed_forward.w3,
        model.layers.2.feed_forward.w1, model.layers.2.feed_forward.w2, model.layers.2.feed_forward.w3,
        model.layers.2.self_attn.k_proj, model.layers.2.self_attn.out_proj, model.layers.2.self_attn.q_proj,
        model.layers.2.self_attn.v_proj, model.layers.3.feed_forward.w1, model.layers.3.feed_forward.w2,
        model.layers.3.feed_forward.w3, model.layers.4.feed_forward.w1, model.layers.4.feed_forward.w2,
        model.layers.4.feed_forward.w3, model.layers.5.feed_forward.w1, model.layers.5.feed_forward.w2,
        model.layers.5.feed_forward.w3, model.layers.5.self_attn.k_proj, model.layers.5.self_attn.out_proj,
        model.layers.5.self_attn.q_proj, model.layers.5.self_attn.v_proj, model.layers.6.feed_forward.w1,
        model.layers.6.feed_forward.w2, model.layers.6.feed_forward.w3, model.layers.7.feed_forward.w1,
        model.layers.7.feed_forward.w2, model.layers.7.feed_forward.w3, model.layers.8.feed_forward.w1,
        model.layers.8.feed_forward.w2, model.layers.8.feed_forward.w3, model.layers.8.self_attn.k_proj,
        model.layers.8.self_attn.out_proj, model.layers.8.self_attn.q_proj, model.layers.8.self_attn.v_proj,
        model.layers.9.feed_forward.w1, model.layers.9.feed_forward.w2, model.layers.9.feed_forward.w3]
      ignore: [lm_head]
      scheme: W8A8
      bypass_divisibility_checks: false