Instructions to use negfir/Distill_SQuAD with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use negfir/Distill_SQuAD with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("fill-mask", model="negfir/Distill_SQuAD")# Load model directly from transformers import AutoTokenizer, AutoModelForMaskedLM tokenizer = AutoTokenizer.from_pretrained("negfir/Distill_SQuAD") model = AutoModelForMaskedLM.from_pretrained("negfir/Distill_SQuAD", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Training in progress, step 500
Browse files- config.json +3 -3
- pytorch_model.bin +2 -2
- runs/Mar24_00-36-09_b5dfe0604ac8/events.out.tfevents.1648082597.b5dfe0604ac8.71.9 +2 -2
- runs/Mar24_00-36-09_b5dfe0604ac8/events.out.tfevents.1648083122.b5dfe0604ac8.71.11 +3 -0
- runs/Mar24_00-53-37_b5dfe0604ac8/1648083225.7308776/events.out.tfevents.1648083225.b5dfe0604ac8.71.13 +3 -0
- runs/Mar24_00-53-37_b5dfe0604ac8/events.out.tfevents.1648083225.b5dfe0604ac8.71.12 +3 -0
- training_args.bin +1 -1
config.json
CHANGED
|
@@ -8,13 +8,13 @@
|
|
| 8 |
"gradient_checkpointing": false,
|
| 9 |
"hidden_act": "gelu",
|
| 10 |
"hidden_dropout_prob": 0.1,
|
| 11 |
-
"hidden_size":
|
| 12 |
"initializer_range": 0.02,
|
| 13 |
-
"intermediate_size":
|
| 14 |
"layer_norm_eps": 1e-12,
|
| 15 |
"max_position_embeddings": 512,
|
| 16 |
"model_type": "bert",
|
| 17 |
-
"num_attention_heads":
|
| 18 |
"num_hidden_layers": 12,
|
| 19 |
"pad_token_id": 0,
|
| 20 |
"position_embedding_type": "absolute",
|
|
|
|
| 8 |
"gradient_checkpointing": false,
|
| 9 |
"hidden_act": "gelu",
|
| 10 |
"hidden_dropout_prob": 0.1,
|
| 11 |
+
"hidden_size": 512,
|
| 12 |
"initializer_range": 0.02,
|
| 13 |
+
"intermediate_size": 2048,
|
| 14 |
"layer_norm_eps": 1e-12,
|
| 15 |
"max_position_embeddings": 512,
|
| 16 |
"model_type": "bert",
|
| 17 |
+
"num_attention_heads": 8,
|
| 18 |
"num_hidden_layers": 12,
|
| 19 |
"pad_token_id": 0,
|
| 20 |
"position_embedding_type": "absolute",
|
pytorch_model.bin
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:958659a448cc079d3ffb77c7b6ebb5e336f558d94f8fe9b6ea39096b37bfc565
|
| 3 |
+
size 216142827
|
runs/Mar24_00-36-09_b5dfe0604ac8/events.out.tfevents.1648082597.b5dfe0604ac8.71.9
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:42717702662efc98c2004ce1ad58d65046c60f669b490ee265b53ebd691d4cd3
|
| 3 |
+
size 4848
|
runs/Mar24_00-36-09_b5dfe0604ac8/events.out.tfevents.1648083122.b5dfe0604ac8.71.11
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:39caa97ca51d3f3248ec0c2d4bc220edac45ba6e6065dfc49185c15d256ee0d2
|
| 3 |
+
size 311
|
runs/Mar24_00-53-37_b5dfe0604ac8/1648083225.7308776/events.out.tfevents.1648083225.b5dfe0604ac8.71.13
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:8a38fbeec2dc24cf1506522e111c8565990a8650d3b97e595e0068d5bca295a0
|
| 3 |
+
size 4758
|
runs/Mar24_00-53-37_b5dfe0604ac8/events.out.tfevents.1648083225.b5dfe0604ac8.71.12
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:511309e533f48fac58048c165c29c2216b9933b11e88ed32ed8bbcba485fb149
|
| 3 |
+
size 3452
|
training_args.bin
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
size 3055
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:9aa0f7647208dc9c742ca905eab43e214c0af9982dafb1d2cb6160d355970035
|
| 3 |
size 3055
|