Instructions to use PRATYUSH-BHARDWAJ/Cortex_A_0.5 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use PRATYUSH-BHARDWAJ/Cortex_A_0.5 with Transformers:
# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("PRATYUSH-BHARDWAJ/Cortex_A_0.5", device_map="auto") - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- Unsloth Desktop
SFT checkpoint step 8
Browse files
checkpoints/checkpoint-8/time_state.json
CHANGED
|
@@ -1 +1 @@
|
|
| 1 |
-
{"consumed_seconds":
|
|
|
|
| 1 |
+
{"consumed_seconds": 127.434410572052, "global_step": 8}
|
checkpoints/checkpoint-8/trainer_state.json
CHANGED
|
@@ -17,15 +17,15 @@
|
|
| 17 |
"num_input_tokens_seen": 1494,
|
| 18 |
"num_tokens": 1494.0,
|
| 19 |
"step": 1,
|
| 20 |
-
"train_runtime":
|
| 21 |
-
"train_tokens_per_second":
|
| 22 |
},
|
| 23 |
{
|
| 24 |
"epoch": 0.06956521739130435,
|
| 25 |
"eval_loss": 5.31978178024292,
|
| 26 |
"eval_num_tokens": 4980.0,
|
| 27 |
-
"eval_runtime": 28.
|
| 28 |
-
"eval_samples_per_second": 1.
|
| 29 |
"eval_steps_per_second": 0.279,
|
| 30 |
"num_input_tokens_seen": 4980,
|
| 31 |
"step": 4
|
|
@@ -34,9 +34,9 @@
|
|
| 34 |
"epoch": 0.1391304347826087,
|
| 35 |
"eval_loss": 5.31978178024292,
|
| 36 |
"eval_num_tokens": 9004.0,
|
| 37 |
-
"eval_runtime": 3.
|
| 38 |
-
"eval_samples_per_second": 8.
|
| 39 |
-
"eval_steps_per_second": 2.
|
| 40 |
"num_input_tokens_seen": 9004,
|
| 41 |
"step": 8
|
| 42 |
}
|
|
|
|
| 17 |
"num_input_tokens_seen": 1494,
|
| 18 |
"num_tokens": 1494.0,
|
| 19 |
"step": 1,
|
| 20 |
+
"train_runtime": 42.4619,
|
| 21 |
+
"train_tokens_per_second": 35.185
|
| 22 |
},
|
| 23 |
{
|
| 24 |
"epoch": 0.06956521739130435,
|
| 25 |
"eval_loss": 5.31978178024292,
|
| 26 |
"eval_num_tokens": 4980.0,
|
| 27 |
+
"eval_runtime": 28.7144,
|
| 28 |
+
"eval_samples_per_second": 1.045,
|
| 29 |
"eval_steps_per_second": 0.279,
|
| 30 |
"num_input_tokens_seen": 4980,
|
| 31 |
"step": 4
|
|
|
|
| 34 |
"epoch": 0.1391304347826087,
|
| 35 |
"eval_loss": 5.31978178024292,
|
| 36 |
"eval_num_tokens": 9004.0,
|
| 37 |
+
"eval_runtime": 3.4006,
|
| 38 |
+
"eval_samples_per_second": 8.822,
|
| 39 |
+
"eval_steps_per_second": 2.353,
|
| 40 |
"num_input_tokens_seen": 9004,
|
| 41 |
"step": 8
|
| 42 |
}
|