Update config.json
Browse files- config.json +4 -4
config.json
CHANGED
|
@@ -19,7 +19,7 @@
|
|
| 19 |
"n_embd": 384,
|
| 20 |
"hidden_size": 384,
|
| 21 |
"dropout": 0.0,
|
| 22 |
-
"attention_backend": "
|
| 23 |
"available_attention_backends": [
|
| 24 |
"sage",
|
| 25 |
"torch",
|
|
@@ -27,12 +27,12 @@
|
|
| 27 |
"flash3"
|
| 28 |
],
|
| 29 |
"trained_attention_backend": "torch",
|
| 30 |
-
"torch_fallback":
|
| 31 |
-
"torch_dtype": "
|
| 32 |
"transformers_version": "custom",
|
| 33 |
"pad_token_id": 0,
|
| 34 |
"bos_token_id": 5,
|
| 35 |
"eos_token_id": 6,
|
| 36 |
"sep_token_id": 2,
|
| 37 |
"unk_token_id": 1
|
| 38 |
-
}
|
|
|
|
| 19 |
"n_embd": 384,
|
| 20 |
"hidden_size": 384,
|
| 21 |
"dropout": 0.0,
|
| 22 |
+
"attention_backend": "torch",
|
| 23 |
"available_attention_backends": [
|
| 24 |
"sage",
|
| 25 |
"torch",
|
|
|
|
| 27 |
"flash3"
|
| 28 |
],
|
| 29 |
"trained_attention_backend": "torch",
|
| 30 |
+
"torch_fallback": true,
|
| 31 |
+
"torch_dtype": "float16",
|
| 32 |
"transformers_version": "custom",
|
| 33 |
"pad_token_id": 0,
|
| 34 |
"bos_token_id": 5,
|
| 35 |
"eos_token_id": 6,
|
| 36 |
"sep_token_id": 2,
|
| 37 |
"unk_token_id": 1
|
| 38 |
+
}
|