hf-transformers-bot commited on
Commit
c216cc2
·
verified ·
1 Parent(s): 7009df3

Update tiny models for PegasusXModel

Browse files
Files changed (4) hide show
  1. config.json +36 -0
  2. model.safetensors +3 -0
  3. tokenizer.json +0 -0
  4. tokenizer_config.json +119 -0
config.json ADDED
@@ -0,0 +1,36 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "activation_dropout": 0.0,
3
+ "activation_function": "gelu",
4
+ "architectures": [
5
+ "PegasusXModel"
6
+ ],
7
+ "attention_dropout": 0.1,
8
+ "block_size": 512,
9
+ "bos_token_id": 0,
10
+ "d_model": 16,
11
+ "decoder_attention_heads": 4,
12
+ "decoder_ffn_dim": 4,
13
+ "decoder_layerdrop": 0.0,
14
+ "decoder_layers": 2,
15
+ "decoder_start_token_id": 0,
16
+ "dropout": 0.1,
17
+ "dtype": "float32",
18
+ "encoder_attention_heads": 4,
19
+ "encoder_ffn_dim": 4,
20
+ "encoder_layerdrop": 0.0,
21
+ "encoder_layers": 2,
22
+ "eos_token_id": 1,
23
+ "forced_eos_token_id": 1,
24
+ "init_std": 0.02,
25
+ "is_encoder_decoder": true,
26
+ "max_position_embeddings": 200,
27
+ "model_type": "pegasus_x",
28
+ "num_global_tokens": 32,
29
+ "pad_token_id": 0,
30
+ "scale_embedding": true,
31
+ "stagger_local_blocks": false,
32
+ "tie_word_embeddings": true,
33
+ "transformers_version": "5.16.0.dev0",
34
+ "use_cache": true,
35
+ "vocab_size": 96103
36
+ }
model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9c5814c27c1af33dc8b37bba73a2a049c7499b6edcaffe8af6a5502fa2930872
3
+ size 6188320
tokenizer.json ADDED
The diff for this file is too large to render. See raw diff
 
tokenizer_config.json ADDED
@@ -0,0 +1,119 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "backend": "tokenizers",
3
+ "eos_token": "</s>",
4
+ "extra_special_tokens": [
5
+ "<mask_1>",
6
+ "<unk_2>",
7
+ "<unk_3>",
8
+ "<unk_4>",
9
+ "<unk_5>",
10
+ "<unk_6>",
11
+ "<unk_7>",
12
+ "<unk_8>",
13
+ "<unk_9>",
14
+ "<unk_10>",
15
+ "<unk_11>",
16
+ "<unk_12>",
17
+ "<unk_13>",
18
+ "<unk_14>",
19
+ "<unk_15>",
20
+ "<unk_16>",
21
+ "<unk_17>",
22
+ "<unk_18>",
23
+ "<unk_19>",
24
+ "<unk_20>",
25
+ "<unk_21>",
26
+ "<unk_22>",
27
+ "<unk_23>",
28
+ "<unk_24>",
29
+ "<unk_25>",
30
+ "<unk_26>",
31
+ "<unk_27>",
32
+ "<unk_28>",
33
+ "<unk_29>",
34
+ "<unk_30>",
35
+ "<unk_31>",
36
+ "<unk_32>",
37
+ "<unk_33>",
38
+ "<unk_34>",
39
+ "<unk_35>",
40
+ "<unk_36>",
41
+ "<unk_37>",
42
+ "<unk_38>",
43
+ "<unk_39>",
44
+ "<unk_40>",
45
+ "<unk_41>",
46
+ "<unk_42>",
47
+ "<unk_43>",
48
+ "<unk_44>",
49
+ "<unk_45>",
50
+ "<unk_46>",
51
+ "<unk_47>",
52
+ "<unk_48>",
53
+ "<unk_49>",
54
+ "<unk_50>",
55
+ "<unk_51>",
56
+ "<unk_52>",
57
+ "<unk_53>",
58
+ "<unk_54>",
59
+ "<unk_55>",
60
+ "<unk_56>",
61
+ "<unk_57>",
62
+ "<unk_58>",
63
+ "<unk_59>",
64
+ "<unk_60>",
65
+ "<unk_61>",
66
+ "<unk_62>",
67
+ "<unk_63>",
68
+ "<unk_64>",
69
+ "<unk_65>",
70
+ "<unk_66>",
71
+ "<unk_67>",
72
+ "<unk_68>",
73
+ "<unk_69>",
74
+ "<unk_70>",
75
+ "<unk_71>",
76
+ "<unk_72>",
77
+ "<unk_73>",
78
+ "<unk_74>",
79
+ "<unk_75>",
80
+ "<unk_76>",
81
+ "<unk_77>",
82
+ "<unk_78>",
83
+ "<unk_79>",
84
+ "<unk_80>",
85
+ "<unk_81>",
86
+ "<unk_82>",
87
+ "<unk_83>",
88
+ "<unk_84>",
89
+ "<unk_85>",
90
+ "<unk_86>",
91
+ "<unk_87>",
92
+ "<unk_88>",
93
+ "<unk_89>",
94
+ "<unk_90>",
95
+ "<unk_91>",
96
+ "<unk_92>",
97
+ "<unk_93>",
98
+ "<unk_94>",
99
+ "<unk_95>",
100
+ "<unk_96>",
101
+ "<unk_97>",
102
+ "<unk_98>",
103
+ "<unk_99>",
104
+ "<unk_100>",
105
+ "<unk_101>",
106
+ "<unk_102>"
107
+ ],
108
+ "full_tokenizer_file": null,
109
+ "is_local": true,
110
+ "local_files_only": false,
111
+ "mask_token": "<mask_2>",
112
+ "mask_token_sent": "<mask_1>",
113
+ "model_max_length": 200,
114
+ "offset": 103,
115
+ "pad_token": "<pad>",
116
+ "sp_model_kwargs": {},
117
+ "tokenizer_class": "TokenizersBackend",
118
+ "unk_token": "<unk>"
119
+ }