hf-transformers-bot commited on
Commit
09d31f8
·
verified ·
1 Parent(s): b23f265

Update tiny models for MBartForCausalLM

Browse files
.gitattributes CHANGED
@@ -33,3 +33,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
 
 
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ tokenizer.json filter=lfs diff=lfs merge=lfs -text
config.json ADDED
@@ -0,0 +1,35 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "activation_dropout": 0.0,
3
+ "activation_function": "gelu",
4
+ "architectures": [
5
+ "MBartForCausalLM"
6
+ ],
7
+ "attention_dropout": 0.1,
8
+ "bos_token_id": 0,
9
+ "classifier_dropout": 0.0,
10
+ "d_model": 16,
11
+ "decoder_attention_heads": 4,
12
+ "decoder_ffn_dim": 4,
13
+ "decoder_layerdrop": 0.0,
14
+ "decoder_layers": 2,
15
+ "decoder_start_token_id": null,
16
+ "dropout": 0.1,
17
+ "dtype": "float32",
18
+ "encoder_attention_heads": 4,
19
+ "encoder_ffn_dim": 4,
20
+ "encoder_layerdrop": 0.0,
21
+ "encoder_layers": 2,
22
+ "eos_token_id": 2,
23
+ "forced_eos_token_id": 2,
24
+ "init_std": 0.02,
25
+ "is_decoder": true,
26
+ "is_encoder_decoder": false,
27
+ "max_position_embeddings": 200,
28
+ "model_type": "mbart",
29
+ "pad_token_id": 1,
30
+ "scale_embedding": false,
31
+ "tie_word_embeddings": true,
32
+ "transformers_version": "5.16.0.dev0",
33
+ "use_cache": true,
34
+ "vocab_size": 250027
35
+ }
generation_config.json ADDED
@@ -0,0 +1,11 @@
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "_from_model_config": true,
3
+ "bos_token_id": 0,
4
+ "eos_token_id": 2,
5
+ "forced_eos_token_id": 2,
6
+ "output_attentions": false,
7
+ "output_hidden_states": false,
8
+ "pad_token_id": 1,
9
+ "transformers_version": "5.16.0.dev0",
10
+ "use_cache": true
11
+ }
model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:0757552051ecaf62cb6c03c1b114cd33611ed02c45b873614387f5cd8b52e502
3
+ size 16040808
tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ae80bd6c2478e1bb552fdc9b9502b48a8370d39ef82ddb6252e4ee466e938fcd
3
+ size 16786822
tokenizer_config.json ADDED
@@ -0,0 +1,43 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "backend": "tokenizers",
3
+ "bos_token": "<s>",
4
+ "cls_token": "<s>",
5
+ "eos_token": "</s>",
6
+ "extra_special_tokens": [
7
+ "ar_AR",
8
+ "cs_CZ",
9
+ "de_DE",
10
+ "en_XX",
11
+ "es_XX",
12
+ "et_EE",
13
+ "fi_FI",
14
+ "fr_XX",
15
+ "gu_IN",
16
+ "hi_IN",
17
+ "it_IT",
18
+ "ja_XX",
19
+ "kk_KZ",
20
+ "ko_KR",
21
+ "lt_LT",
22
+ "lv_LV",
23
+ "my_MM",
24
+ "ne_NP",
25
+ "nl_XX",
26
+ "ro_RO",
27
+ "ru_RU",
28
+ "si_LK",
29
+ "tr_TR",
30
+ "vi_VN",
31
+ "zh_CN"
32
+ ],
33
+ "is_local": true,
34
+ "local_files_only": false,
35
+ "mask_token": "<mask>",
36
+ "model_max_length": 200,
37
+ "pad_token": "<pad>",
38
+ "sep_token": "</s>",
39
+ "src_lang": "en_XX",
40
+ "tgt_lang": null,
41
+ "tokenizer_class": "MBartTokenizer",
42
+ "unk_token": "<unk>"
43
+ }