Instructions to use VQA-DeepLearning/gemma_4_lora_E4b with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use VQA-DeepLearning/gemma_4_lora_E4b with Transformers:
# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("VQA-DeepLearning/gemma_4_lora_E4b", device_map="auto") - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- Unsloth Studio
How to use VQA-DeepLearning/gemma_4_lora_E4b with Unsloth Studio:
Install Unsloth Studio (macOS, Linux, WSL)
curl -fsSL https://unsloth.ai/install.sh | sh # Run unsloth studio unsloth studio -H 0.0.0.0 -p 8888 # Then open http://localhost:8888 in your browser # Search for VQA-DeepLearning/gemma_4_lora_E4b to start chatting
Install Unsloth Studio (Windows)
irm https://unsloth.ai/install.ps1 | iex # Run unsloth studio unsloth studio -H 0.0.0.0 -p 8888 # Then open http://localhost:8888 in your browser # Search for VQA-DeepLearning/gemma_4_lora_E4b to start chatting
Using HuggingFace Spaces for Unsloth
# No setup required # Open https://huggingface.co/spaces/unsloth/studio in your browser # Search for VQA-DeepLearning/gemma_4_lora_E4b to start chatting
Load model with FastModel
pip install unsloth from unsloth import FastModel model, tokenizer = FastModel.from_pretrained( model_name="VQA-DeepLearning/gemma_4_lora_E4b", max_seq_length=2048, )
Training in progress, step 150, checkpoint
Browse files
checkpoint-150/adapter_model.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
size 165012392
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:8deb0060d7358aeabd1230137b33365c199273f1adea1fb63f5896477c8c3c65
|
| 3 |
size 165012392
|
checkpoint-150/optimizer.pt
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
size 84690389
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:f6e5566d2fb0d78e03b6c33471dcf154fb8928ec5659362421bf60549d15e1f0
|
| 3 |
size 84690389
|
checkpoint-150/trainer_state.json
CHANGED
|
@@ -11,115 +11,115 @@
|
|
| 11 |
"log_history": [
|
| 12 |
{
|
| 13 |
"epoch": 0.022308979364194088,
|
| 14 |
-
"grad_norm": 4.
|
| 15 |
"learning_rate": 0.00019999446787180336,
|
| 16 |
-
"loss": 3.
|
| 17 |
"step": 10
|
| 18 |
},
|
| 19 |
{
|
| 20 |
"epoch": 0.044617958728388175,
|
| 21 |
-
"grad_norm": 1.
|
| 22 |
"learning_rate": 0.00019989613595281384,
|
| 23 |
-
"loss":
|
| 24 |
"step": 20
|
| 25 |
},
|
| 26 |
{
|
| 27 |
"epoch": 0.06692693809258227,
|
| 28 |
-
"grad_norm": 1.
|
| 29 |
"learning_rate": 0.00019967500698688952,
|
| 30 |
-
"loss": 0.
|
| 31 |
"step": 30
|
| 32 |
},
|
| 33 |
{
|
| 34 |
"epoch": 0.08923591745677635,
|
| 35 |
-
"grad_norm": 0.
|
| 36 |
"learning_rate": 0.0001993313527961959,
|
| 37 |
-
"loss": 0.
|
| 38 |
"step": 40
|
| 39 |
},
|
| 40 |
{
|
| 41 |
"epoch": 0.11154489682097044,
|
| 42 |
-
"grad_norm": 1.
|
| 43 |
"learning_rate": 0.00019886559581668999,
|
| 44 |
-
"loss": 0.
|
| 45 |
"step": 50
|
| 46 |
},
|
| 47 |
{
|
| 48 |
"epoch": 0.13385387618516453,
|
| 49 |
-
"grad_norm": 0.
|
| 50 |
"learning_rate": 0.00019827830857884173,
|
| 51 |
-
"loss": 0.
|
| 52 |
"step": 60
|
| 53 |
},
|
| 54 |
{
|
| 55 |
"epoch": 0.1561628555493586,
|
| 56 |
-
"grad_norm": 0.
|
| 57 |
"learning_rate": 0.00019757021300385286,
|
| 58 |
-
"loss": 0.
|
| 59 |
"step": 70
|
| 60 |
},
|
| 61 |
{
|
| 62 |
"epoch": 0.1784718349135527,
|
| 63 |
-
"grad_norm": 0.
|
| 64 |
"learning_rate": 0.00019674217951623707,
|
| 65 |
-
"loss": 0.
|
| 66 |
"step": 80
|
| 67 |
},
|
| 68 |
{
|
| 69 |
"epoch": 0.2007808142777468,
|
| 70 |
-
"grad_norm": 0.
|
| 71 |
"learning_rate": 0.00019579522597385315,
|
| 72 |
-
"loss": 0.
|
| 73 |
"step": 90
|
| 74 |
},
|
| 75 |
{
|
| 76 |
"epoch": 0.22308979364194087,
|
| 77 |
-
"grad_norm": 0.
|
| 78 |
"learning_rate": 0.00019473051641670606,
|
| 79 |
-
"loss": 0.
|
| 80 |
"step": 100
|
| 81 |
},
|
| 82 |
{
|
| 83 |
"epoch": 0.22308979364194087,
|
| 84 |
-
"eval_loss": 8.
|
| 85 |
-
"eval_runtime":
|
| 86 |
-
"eval_samples_per_second": 1.
|
| 87 |
-
"eval_steps_per_second": 1.
|
| 88 |
"step": 100
|
| 89 |
},
|
| 90 |
{
|
| 91 |
"epoch": 0.24539877300613497,
|
| 92 |
-
"grad_norm": 0.
|
| 93 |
"learning_rate": 0.00019354935963605393,
|
| 94 |
-
"loss": 0.
|
| 95 |
"step": 110
|
| 96 |
},
|
| 97 |
{
|
| 98 |
"epoch": 0.26770775237032907,
|
| 99 |
-
"grad_norm": 0.
|
| 100 |
"learning_rate": 0.00019225320756558023,
|
| 101 |
-
"loss": 0.
|
| 102 |
"step": 120
|
| 103 |
},
|
| 104 |
{
|
| 105 |
"epoch": 0.29001673173452314,
|
| 106 |
-
"grad_norm": 0.
|
| 107 |
"learning_rate": 0.0001908436534966081,
|
| 108 |
-
"loss": 0.
|
| 109 |
"step": 130
|
| 110 |
},
|
| 111 |
{
|
| 112 |
"epoch": 0.3123257110987172,
|
| 113 |
-
"grad_norm": 1.
|
| 114 |
"learning_rate": 0.00018932243011955154,
|
| 115 |
-
"loss": 0.
|
| 116 |
"step": 140
|
| 117 |
},
|
| 118 |
{
|
| 119 |
"epoch": 0.33463469046291133,
|
| 120 |
-
"grad_norm": 0.
|
| 121 |
"learning_rate": 0.00018769140739401062,
|
| 122 |
-
"loss": 0.
|
| 123 |
"step": 150
|
| 124 |
}
|
| 125 |
],
|
|
|
|
| 11 |
"log_history": [
|
| 12 |
{
|
| 13 |
"epoch": 0.022308979364194088,
|
| 14 |
+
"grad_norm": 4.709710597991943,
|
| 15 |
"learning_rate": 0.00019999446787180336,
|
| 16 |
+
"loss": 3.676974868774414,
|
| 17 |
"step": 10
|
| 18 |
},
|
| 19 |
{
|
| 20 |
"epoch": 0.044617958728388175,
|
| 21 |
+
"grad_norm": 1.4567488431930542,
|
| 22 |
"learning_rate": 0.00019989613595281384,
|
| 23 |
+
"loss": 0.9999975204467774,
|
| 24 |
"step": 20
|
| 25 |
},
|
| 26 |
{
|
| 27 |
"epoch": 0.06692693809258227,
|
| 28 |
+
"grad_norm": 1.1962672472000122,
|
| 29 |
"learning_rate": 0.00019967500698688952,
|
| 30 |
+
"loss": 0.6824670314788819,
|
| 31 |
"step": 30
|
| 32 |
},
|
| 33 |
{
|
| 34 |
"epoch": 0.08923591745677635,
|
| 35 |
+
"grad_norm": 0.8628137707710266,
|
| 36 |
"learning_rate": 0.0001993313527961959,
|
| 37 |
+
"loss": 0.5993218421936035,
|
| 38 |
"step": 40
|
| 39 |
},
|
| 40 |
{
|
| 41 |
"epoch": 0.11154489682097044,
|
| 42 |
+
"grad_norm": 1.0308934450149536,
|
| 43 |
"learning_rate": 0.00019886559581668999,
|
| 44 |
+
"loss": 0.542162561416626,
|
| 45 |
"step": 50
|
| 46 |
},
|
| 47 |
{
|
| 48 |
"epoch": 0.13385387618516453,
|
| 49 |
+
"grad_norm": 0.9261613488197327,
|
| 50 |
"learning_rate": 0.00019827830857884173,
|
| 51 |
+
"loss": 0.44734554290771483,
|
| 52 |
"step": 60
|
| 53 |
},
|
| 54 |
{
|
| 55 |
"epoch": 0.1561628555493586,
|
| 56 |
+
"grad_norm": 0.9318423867225647,
|
| 57 |
"learning_rate": 0.00019757021300385286,
|
| 58 |
+
"loss": 0.44412760734558104,
|
| 59 |
"step": 70
|
| 60 |
},
|
| 61 |
{
|
| 62 |
"epoch": 0.1784718349135527,
|
| 63 |
+
"grad_norm": 0.5784896612167358,
|
| 64 |
"learning_rate": 0.00019674217951623707,
|
| 65 |
+
"loss": 0.40378632545471194,
|
| 66 |
"step": 80
|
| 67 |
},
|
| 68 |
{
|
| 69 |
"epoch": 0.2007808142777468,
|
| 70 |
+
"grad_norm": 0.7836484909057617,
|
| 71 |
"learning_rate": 0.00019579522597385315,
|
| 72 |
+
"loss": 0.3856403350830078,
|
| 73 |
"step": 90
|
| 74 |
},
|
| 75 |
{
|
| 76 |
"epoch": 0.22308979364194087,
|
| 77 |
+
"grad_norm": 0.6503493189811707,
|
| 78 |
"learning_rate": 0.00019473051641670606,
|
| 79 |
+
"loss": 0.3800614356994629,
|
| 80 |
"step": 100
|
| 81 |
},
|
| 82 |
{
|
| 83 |
"epoch": 0.22308979364194087,
|
| 84 |
+
"eval_loss": 8.158984184265137,
|
| 85 |
+
"eval_runtime": 248.821,
|
| 86 |
+
"eval_samples_per_second": 1.813,
|
| 87 |
+
"eval_steps_per_second": 1.813,
|
| 88 |
"step": 100
|
| 89 |
},
|
| 90 |
{
|
| 91 |
"epoch": 0.24539877300613497,
|
| 92 |
+
"grad_norm": 0.582433819770813,
|
| 93 |
"learning_rate": 0.00019354935963605393,
|
| 94 |
+
"loss": 0.34090685844421387,
|
| 95 |
"step": 110
|
| 96 |
},
|
| 97 |
{
|
| 98 |
"epoch": 0.26770775237032907,
|
| 99 |
+
"grad_norm": 0.6219270825386047,
|
| 100 |
"learning_rate": 0.00019225320756558023,
|
| 101 |
+
"loss": 0.3560009956359863,
|
| 102 |
"step": 120
|
| 103 |
},
|
| 104 |
{
|
| 105 |
"epoch": 0.29001673173452314,
|
| 106 |
+
"grad_norm": 0.5081164836883545,
|
| 107 |
"learning_rate": 0.0001908436534966081,
|
| 108 |
+
"loss": 0.32209837436676025,
|
| 109 |
"step": 130
|
| 110 |
},
|
| 111 |
{
|
| 112 |
"epoch": 0.3123257110987172,
|
| 113 |
+
"grad_norm": 1.0672804117202759,
|
| 114 |
"learning_rate": 0.00018932243011955154,
|
| 115 |
+
"loss": 0.4280549049377441,
|
| 116 |
"step": 140
|
| 117 |
},
|
| 118 |
{
|
| 119 |
"epoch": 0.33463469046291133,
|
| 120 |
+
"grad_norm": 0.5716775059700012,
|
| 121 |
"learning_rate": 0.00018769140739401062,
|
| 122 |
+
"loss": 0.29103860855102537,
|
| 123 |
"step": 150
|
| 124 |
}
|
| 125 |
],
|