dany0407 commited on
Commit
4afe7b1
verified
1 Parent(s): 29865a5

End of training

Browse files
README.md CHANGED
@@ -1,7 +1,7 @@
1
  ---
2
  library_name: transformers
3
  license: apache-2.0
4
- base_model: distilbert/distilbert-base-uncased
5
  tags:
6
  - generated_from_trainer
7
  model-index:
@@ -14,9 +14,9 @@ should probably proofread and complete it, then remove this comment. -->
14
 
15
  # qa_model
16
 
17
- This model is a fine-tuned version of [distilbert/distilbert-base-uncased](https://huggingface.co/distilbert/distilbert-base-uncased) on an unknown dataset.
18
  It achieves the following results on the evaluation set:
19
- - Loss: 1.5772
20
 
21
  ## Model description
22
 
@@ -39,24 +39,20 @@ The following hyperparameters were used during training:
39
  - train_batch_size: 16
40
  - eval_batch_size: 16
41
  - seed: 42
42
- - optimizer: Use OptimizerNames.ADAMW_TORCH with betas=(0.9,0.999) and epsilon=1e-08 and optimizer_args=No additional optimizer arguments
43
  - lr_scheduler_type: linear
44
- - num_epochs: 5
45
 
46
  ### Training results
47
 
48
  | Training Loss | Epoch | Step | Validation Loss |
49
  |:-------------:|:-----:|:----:|:---------------:|
50
- | No log | 1.0 | 250 | 1.9103 |
51
- | 2.2949 | 2.0 | 500 | 1.5307 |
52
- | 2.2949 | 3.0 | 750 | 1.5119 |
53
- | 0.9818 | 4.0 | 1000 | 1.5333 |
54
- | 0.9818 | 5.0 | 1250 | 1.5772 |
55
 
56
 
57
  ### Framework versions
58
 
59
  - Transformers 4.54.1
60
- - Pytorch 2.6.0+cu124
61
  - Datasets 4.0.0
62
  - Tokenizers 0.21.4
 
1
  ---
2
  library_name: transformers
3
  license: apache-2.0
4
+ base_model: bert-base-cased
5
  tags:
6
  - generated_from_trainer
7
  model-index:
 
14
 
15
  # qa_model
16
 
17
+ This model is a fine-tuned version of [bert-base-cased](https://huggingface.co/bert-base-cased) on an unknown dataset.
18
  It achieves the following results on the evaluation set:
19
+ - Loss: 1.4668
20
 
21
  ## Model description
22
 
 
39
  - train_batch_size: 16
40
  - eval_batch_size: 16
41
  - seed: 42
42
+ - optimizer: Use OptimizerNames.ADAMW_TORCH_FUSED with betas=(0.9,0.999) and epsilon=1e-08 and optimizer_args=No additional optimizer arguments
43
  - lr_scheduler_type: linear
44
+ - num_epochs: 1
45
 
46
  ### Training results
47
 
48
  | Training Loss | Epoch | Step | Validation Loss |
49
  |:-------------:|:-----:|:----:|:---------------:|
50
+ | 2.3063 | 1.0 | 508 | 1.4668 |
 
 
 
 
51
 
52
 
53
  ### Framework versions
54
 
55
  - Transformers 4.54.1
56
+ - Pytorch 2.11.0+cu128
57
  - Datasets 4.0.0
58
  - Tokenizers 0.21.4
model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:ef60f1fff8ddb120a90647774e70785ef23fa8c0323c6efef217e9e9a22ab2d8
3
  size 430908208
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ba657de625e1b86d913bc7edba7f6ec0210279d28c55710039690494412ca137
3
  size 430908208
runs/Jun04_04-09-30_95099d001d8d/events.out.tfevents.1780546174.95099d001d8d.3260.0 CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:f80fe7fd051a2143df61c7f7bab292f4761b4c0db798369028c359b17ad36be9
3
- size 5158
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:f0d72fad1743665f77a1f90ef63d899cf1e907f49293de03ab9cae59392d4070
3
+ size 5783