dd3434 commited on
Commit
15827be
·
verified ·
1 Parent(s): 0651610

Training in progress, step 100

Browse files
config.json CHANGED
@@ -1,46 +1,54 @@
1
  {
2
- "_name_or_path": "kykim/bert-kor-base",
 
3
  "architectures": [
4
- "BertForSequenceClassification"
5
  ],
6
- "attention_probs_dropout_prob": 0.1,
7
- "classifier_dropout": null,
8
- "directionality": "bidi",
 
 
 
 
 
 
 
 
 
 
 
 
9
  "embedding_size": 768,
10
- "gradient_checkpointing": false,
11
- "hidden_act": "gelu",
12
- "hidden_dropout_prob": 0.1,
13
- "hidden_size": 768,
14
  "id2label": {
15
  "0": "item",
16
  "1": "non_item",
17
  "2": "garbage",
18
  "3": "review"
19
  },
20
- "initializer_range": 0.02,
21
- "intermediate_size": 3072,
22
  "label2id": {
23
  "garbage": 2,
24
  "item": 0,
25
  "non_item": 1,
26
  "review": 3
27
  },
28
- "layer_norm_eps": 1e-12,
29
  "max_position_embeddings": 512,
30
- "model_type": "bert",
31
- "num_attention_heads": 12,
32
- "num_hidden_layers": 12,
33
- "pad_token_id": 0,
34
- "pooler_fc_size": 768,
35
- "pooler_num_attention_heads": 12,
36
- "pooler_num_fc_layers": 3,
37
- "pooler_size_per_head": 128,
38
- "pooler_type": "first_token_transform",
39
- "position_embedding_type": "absolute",
40
  "problem_type": "single_label_classification",
 
 
41
  "torch_dtype": "float32",
42
  "transformers_version": "4.32.0",
43
- "type_vocab_size": 2,
44
- "use_cache": true,
45
  "vocab_size": 42000
46
  }
 
1
  {
2
+ "_name_or_path": "kykim/funnel-kor-base",
3
+ "activation_dropout": 0.0,
4
  "architectures": [
5
+ "FunnelForSequenceClassification"
6
  ],
7
+ "attention_dropout": 0.1,
8
+ "attention_type": "relative_shift",
9
+ "block_repeats": [
10
+ 1,
11
+ 1,
12
+ 1
13
+ ],
14
+ "block_sizes": [
15
+ 6,
16
+ 6,
17
+ 6
18
+ ],
19
+ "d_head": 64,
20
+ "d_inner": 3072,
21
+ "d_model": 768,
22
  "embedding_size": 768,
23
+ "hidden_act": "gelu_new",
24
+ "hidden_dropout": 0.1,
 
 
25
  "id2label": {
26
  "0": "item",
27
  "1": "non_item",
28
  "2": "garbage",
29
  "3": "review"
30
  },
31
+ "initializer_range": 0.1,
32
+ "initializer_std": 0.02,
33
  "label2id": {
34
  "garbage": 2,
35
  "item": 0,
36
  "non_item": 1,
37
  "review": 3
38
  },
39
+ "layer_norm_eps": 1e-09,
40
  "max_position_embeddings": 512,
41
+ "model_type": "funnel",
42
+ "n_head": 12,
43
+ "num_decoder_layers": 2,
44
+ "pool_q_only": true,
45
+ "pooling_type": "mean",
 
 
 
 
 
46
  "problem_type": "single_label_classification",
47
+ "rel_attn_type": "factorized",
48
+ "separate_cls": true,
49
  "torch_dtype": "float32",
50
  "transformers_version": "4.32.0",
51
+ "truncate_seq": true,
52
+ "type_vocab_size": 3,
53
  "vocab_size": 42000
54
  }
pytorch_model.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:bb3494620bcb22a346ddd8998dc474e2040ba8aa074aca54907ab52367d7efdf
3
- size 473270510
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:87bfce63c841cd79bb028372104a643497711b535441e65ff80bea01d6e4ac56
3
+ size 684546438
special_tokens_map.json CHANGED
@@ -1,7 +1,9 @@
1
  {
2
- "cls_token": "[CLS]",
3
- "mask_token": "[MASK]",
4
- "pad_token": "[PAD]",
5
- "sep_token": "[SEP]",
6
- "unk_token": "[UNK]"
 
 
7
  }
 
1
  {
2
+ "bos_token": "<s>",
3
+ "cls_token": "<cls>",
4
+ "eos_token": "</s>",
5
+ "mask_token": "<mask>",
6
+ "pad_token": "<pad>",
7
+ "sep_token": "<sep>",
8
+ "unk_token": "<unk>"
9
  }
tokenizer.json CHANGED
@@ -10,7 +10,7 @@
10
  "added_tokens": [
11
  {
12
  "id": 0,
13
- "content": "[PAD]",
14
  "single_word": false,
15
  "lstrip": false,
16
  "rstrip": false,
@@ -19,7 +19,7 @@
19
  },
20
  {
21
  "id": 1,
22
- "content": "[UNK]",
23
  "single_word": false,
24
  "lstrip": false,
25
  "rstrip": false,
@@ -28,7 +28,7 @@
28
  },
29
  {
30
  "id": 2,
31
- "content": "[CLS]",
32
  "single_word": false,
33
  "lstrip": false,
34
  "rstrip": false,
@@ -37,7 +37,7 @@
37
  },
38
  {
39
  "id": 3,
40
- "content": "[SEP]",
41
  "single_word": false,
42
  "lstrip": false,
43
  "rstrip": false,
@@ -46,7 +46,25 @@
46
  },
47
  {
48
  "id": 4,
49
- "content": "[MASK]",
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
50
  "single_word": false,
51
  "lstrip": false,
52
  "rstrip": false,
@@ -69,8 +87,8 @@
69
  "single": [
70
  {
71
  "SpecialToken": {
72
- "id": "[CLS]",
73
- "type_id": 0
74
  }
75
  },
76
  {
@@ -81,7 +99,7 @@
81
  },
82
  {
83
  "SpecialToken": {
84
- "id": "[SEP]",
85
  "type_id": 0
86
  }
87
  }
@@ -89,8 +107,8 @@
89
  "pair": [
90
  {
91
  "SpecialToken": {
92
- "id": "[CLS]",
93
- "type_id": 0
94
  }
95
  },
96
  {
@@ -101,7 +119,7 @@
101
  },
102
  {
103
  "SpecialToken": {
104
- "id": "[SEP]",
105
  "type_id": 0
106
  }
107
  },
@@ -113,28 +131,28 @@
113
  },
114
  {
115
  "SpecialToken": {
116
- "id": "[SEP]",
117
  "type_id": 1
118
  }
119
  }
120
  ],
121
  "special_tokens": {
122
- "[CLS]": {
123
- "id": "[CLS]",
124
  "ids": [
125
  2
126
  ],
127
  "tokens": [
128
- "[CLS]"
129
  ]
130
  },
131
- "[SEP]": {
132
- "id": "[SEP]",
133
  "ids": [
134
  3
135
  ],
136
  "tokens": [
137
- "[SEP]"
138
  ]
139
  }
140
  }
@@ -146,19 +164,19 @@
146
  },
147
  "model": {
148
  "type": "WordPiece",
149
- "unk_token": "[UNK]",
150
  "continuing_subword_prefix": "##",
151
  "max_input_chars_per_word": 100,
152
  "vocab": {
153
- "[PAD]": 0,
154
- "[UNK]": 1,
155
- "[CLS]": 2,
156
- "[SEP]": 3,
157
- "[MASK]": 4,
158
- "[unused0]": 5,
159
- "[unused1]": 6,
160
- "[unused2]": 7,
161
- "[unused3]": 8,
162
  "[unused4]": 9,
163
  "[unused5]": 10,
164
  "[unused6]": 11,
 
10
  "added_tokens": [
11
  {
12
  "id": 0,
13
+ "content": "<pad>",
14
  "single_word": false,
15
  "lstrip": false,
16
  "rstrip": false,
 
19
  },
20
  {
21
  "id": 1,
22
+ "content": "<unk>",
23
  "single_word": false,
24
  "lstrip": false,
25
  "rstrip": false,
 
28
  },
29
  {
30
  "id": 2,
31
+ "content": "<cls>",
32
  "single_word": false,
33
  "lstrip": false,
34
  "rstrip": false,
 
37
  },
38
  {
39
  "id": 3,
40
+ "content": "<sep>",
41
  "single_word": false,
42
  "lstrip": false,
43
  "rstrip": false,
 
46
  },
47
  {
48
  "id": 4,
49
+ "content": "<mask>",
50
+ "single_word": false,
51
+ "lstrip": false,
52
+ "rstrip": false,
53
+ "normalized": false,
54
+ "special": true
55
+ },
56
+ {
57
+ "id": 5,
58
+ "content": "<s>",
59
+ "single_word": false,
60
+ "lstrip": false,
61
+ "rstrip": false,
62
+ "normalized": false,
63
+ "special": true
64
+ },
65
+ {
66
+ "id": 6,
67
+ "content": "</s>",
68
  "single_word": false,
69
  "lstrip": false,
70
  "rstrip": false,
 
87
  "single": [
88
  {
89
  "SpecialToken": {
90
+ "id": "<cls>",
91
+ "type_id": 2
92
  }
93
  },
94
  {
 
99
  },
100
  {
101
  "SpecialToken": {
102
+ "id": "<sep>",
103
  "type_id": 0
104
  }
105
  }
 
107
  "pair": [
108
  {
109
  "SpecialToken": {
110
+ "id": "<cls>",
111
+ "type_id": 2
112
  }
113
  },
114
  {
 
119
  },
120
  {
121
  "SpecialToken": {
122
+ "id": "<sep>",
123
  "type_id": 0
124
  }
125
  },
 
131
  },
132
  {
133
  "SpecialToken": {
134
+ "id": "<sep>",
135
  "type_id": 1
136
  }
137
  }
138
  ],
139
  "special_tokens": {
140
+ "<cls>": {
141
+ "id": "<cls>",
142
  "ids": [
143
  2
144
  ],
145
  "tokens": [
146
+ "<cls>"
147
  ]
148
  },
149
+ "<sep>": {
150
+ "id": "<sep>",
151
  "ids": [
152
  3
153
  ],
154
  "tokens": [
155
+ "<sep>"
156
  ]
157
  }
158
  }
 
164
  },
165
  "model": {
166
  "type": "WordPiece",
167
+ "unk_token": "<unk>",
168
  "continuing_subword_prefix": "##",
169
  "max_input_chars_per_word": 100,
170
  "vocab": {
171
+ "<pad>": 0,
172
+ "<unk>": 1,
173
+ "<cls>": 2,
174
+ "<sep>": 3,
175
+ "<mask>": 4,
176
+ "<s>": 5,
177
+ "</s>": 6,
178
+ "<eod>": 7,
179
+ "<eop>": 8,
180
  "[unused4]": 9,
181
  "[unused5]": 10,
182
  "[unused6]": 11,
tokenizer_config.json CHANGED
@@ -1,15 +1,19 @@
1
  {
 
 
2
  "clean_up_tokenization_spaces": true,
3
- "cls_token": "[CLS]",
4
  "do_basic_tokenize": true,
5
  "do_lower_case": true,
6
- "mask_token": "[MASK]",
 
7
  "model_max_length": 512,
8
  "never_split": null,
9
- "pad_token": "[PAD]",
10
- "sep_token": "[SEP]",
11
  "strip_accents": false,
12
  "tokenize_chinese_chars": true,
13
- "tokenizer_class": "BertTokenizer",
14
- "unk_token": "[UNK]"
 
15
  }
 
1
  {
2
+ "bos_token": "<s>",
3
+ "clean_text": true,
4
  "clean_up_tokenization_spaces": true,
5
+ "cls_token": "<cls>",
6
  "do_basic_tokenize": true,
7
  "do_lower_case": true,
8
+ "eos_token": "</s>",
9
+ "mask_token": "<mask>",
10
  "model_max_length": 512,
11
  "never_split": null,
12
+ "pad_token": "<pad>",
13
+ "sep_token": "<sep>",
14
  "strip_accents": false,
15
  "tokenize_chinese_chars": true,
16
+ "tokenizer_class": "FunnelTokenizer",
17
+ "unk_token": "<unk>",
18
+ "wordpieces_prefix": "##"
19
  }
training_args.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:a1f7d315177df05497b5918048ea9caed7d58672564736c0b364143181096f72
3
  size 4472
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5d9a5a04723c7b140f278b33665efcfdaa8934f2abd07e0d4349157e35f33bb1
3
  size 4472
vocab.txt CHANGED
@@ -1,12 +1,12 @@
1
- [PAD]
2
- [UNK]
3
- [CLS]
4
- [SEP]
5
- [MASK]
6
- [unused0]
7
- [unused1]
8
- [unused2]
9
- [unused3]
10
  [unused4]
11
  [unused5]
12
  [unused6]
 
1
+ <pad>
2
+ <unk>
3
+ <cls>
4
+ <sep>
5
+ <mask>
6
+ <s>
7
+ </s>
8
+ <eod>
9
+ <eop>
10
  [unused4]
11
  [unused5]
12
  [unused6]