shanaka95 commited on
Commit
f1ebad8
·
verified ·
1 Parent(s): b864498

Upload model trained with Unsloth

Browse files

Upload model trained with Unsloth 2x faster

Files changed (2) hide show
  1. adapter_config.json +4 -4
  2. adapter_model.safetensors +2 -2
adapter_config.json CHANGED
@@ -7,7 +7,7 @@
7
  "parent_library": "transformers.models.gemma4.modeling_gemma4",
8
  "unsloth_fixed": true
9
  },
10
- "base_model_name_or_path": "unsloth/gemma-4-E4B-it",
11
  "bias": "none",
12
  "corda_config": null,
13
  "ensure_weight_tying": false,
@@ -20,7 +20,7 @@
20
  "layers_pattern": null,
21
  "layers_to_transform": null,
22
  "loftq_config": {},
23
- "lora_alpha": 32,
24
  "lora_bias": false,
25
  "lora_dropout": 0,
26
  "lora_ga_config": null,
@@ -28,9 +28,9 @@
28
  "megatron_core": "megatron.core",
29
  "modules_to_save": null,
30
  "peft_type": "LORA",
31
- "peft_version": "0.19.0",
32
  "qalora_group_size": 16,
33
- "r": 32,
34
  "rank_pattern": {},
35
  "revision": null,
36
  "target_modules": "(?:.*?(?:vision|image|visual|patch|language|text).*?(?:self_attn|attention|attn|mlp|feed_forward|ffn|dense).*?(?:k_proj|q_proj|v_proj|o_proj|gate_proj|up_proj|down_proj|per_layer_input_gate|per_layer_projection|linear|embedding_projection|relative_k_proj).*?)|(?:\\bmodel\\.layers\\.[\\d]{1,}\\.(?:self_attn|attention|attn|mlp|feed_forward|ffn|dense)\\.(?:(?:k_proj|q_proj|v_proj|o_proj|gate_proj|up_proj|down_proj|per_layer_input_gate|per_layer_projection|linear|embedding_projection|relative_k_proj)))",
 
7
  "parent_library": "transformers.models.gemma4.modeling_gemma4",
8
  "unsloth_fixed": true
9
  },
10
+ "base_model_name_or_path": "unsloth/gemma-4-E2B-it",
11
  "bias": "none",
12
  "corda_config": null,
13
  "ensure_weight_tying": false,
 
20
  "layers_pattern": null,
21
  "layers_to_transform": null,
22
  "loftq_config": {},
23
+ "lora_alpha": 16,
24
  "lora_bias": false,
25
  "lora_dropout": 0,
26
  "lora_ga_config": null,
 
28
  "megatron_core": "megatron.core",
29
  "modules_to_save": null,
30
  "peft_type": "LORA",
31
+ "peft_version": "0.19.1",
32
  "qalora_group_size": 16,
33
+ "r": 16,
34
  "rank_pattern": {},
35
  "revision": null,
36
  "target_modules": "(?:.*?(?:vision|image|visual|patch|language|text).*?(?:self_attn|attention|attn|mlp|feed_forward|ffn|dense).*?(?:k_proj|q_proj|v_proj|o_proj|gate_proj|up_proj|down_proj|per_layer_input_gate|per_layer_projection|linear|embedding_projection|relative_k_proj).*?)|(?:\\bmodel\\.layers\\.[\\d]{1,}\\.(?:self_attn|attention|attn|mlp|feed_forward|ffn|dense)\\.(?:(?:k_proj|q_proj|v_proj|o_proj|gate_proj|up_proj|down_proj|per_layer_input_gate|per_layer_projection|linear|embedding_projection|relative_k_proj)))",
adapter_model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:032eb607cd6be007ebef72591f4ddd109130d65a92ae058d8046b1b75ad3ef66
3
- size 329901416
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:acf29969b4fab811b4dba7df2761c92e23f08abe3e48bc8fc62badfa9bed2f1f
3
+ size 119548152