dd3434 commited on
Commit
56dfae2
·
verified ·
1 Parent(s): 3c540a0

Training in progress, step 100

Browse files
config.json CHANGED
@@ -1,54 +1,46 @@
1
  {
2
- "_name_or_path": "kykim/funnel-kor-base",
3
- "activation_dropout": 0.0,
4
  "architectures": [
5
- "FunnelForSequenceClassification"
6
  ],
7
- "attention_dropout": 0.1,
8
- "attention_type": "relative_shift",
9
- "block_repeats": [
10
- 1,
11
- 1,
12
- 1
13
- ],
14
- "block_sizes": [
15
- 6,
16
- 6,
17
- 6
18
- ],
19
- "d_head": 64,
20
- "d_inner": 3072,
21
- "d_model": 768,
22
  "embedding_size": 768,
23
- "hidden_act": "gelu_new",
24
- "hidden_dropout": 0.1,
 
 
25
  "id2label": {
26
  "0": "item",
27
  "1": "non_item",
28
  "2": "garbage",
29
  "3": "review"
30
  },
31
- "initializer_range": 0.1,
32
- "initializer_std": 0.02,
33
  "label2id": {
34
  "garbage": 2,
35
  "item": 0,
36
  "non_item": 1,
37
  "review": 3
38
  },
39
- "layer_norm_eps": 1e-09,
40
  "max_position_embeddings": 512,
41
- "model_type": "funnel",
42
- "n_head": 12,
43
- "num_decoder_layers": 2,
44
- "pool_q_only": true,
45
- "pooling_type": "mean",
 
 
 
 
 
46
  "problem_type": "single_label_classification",
47
- "rel_attn_type": "factorized",
48
- "separate_cls": true,
49
  "torch_dtype": "float32",
50
  "transformers_version": "4.32.0",
51
- "truncate_seq": true,
52
- "type_vocab_size": 3,
53
  "vocab_size": 42000
54
  }
 
1
  {
2
+ "_name_or_path": "kykim/bert-kor-base",
 
3
  "architectures": [
4
+ "BertForSequenceClassification"
5
  ],
6
+ "attention_probs_dropout_prob": 0.1,
7
+ "classifier_dropout": null,
8
+ "directionality": "bidi",
 
 
 
 
 
 
 
 
 
 
 
 
9
  "embedding_size": 768,
10
+ "gradient_checkpointing": false,
11
+ "hidden_act": "gelu",
12
+ "hidden_dropout_prob": 0.1,
13
+ "hidden_size": 768,
14
  "id2label": {
15
  "0": "item",
16
  "1": "non_item",
17
  "2": "garbage",
18
  "3": "review"
19
  },
20
+ "initializer_range": 0.02,
21
+ "intermediate_size": 3072,
22
  "label2id": {
23
  "garbage": 2,
24
  "item": 0,
25
  "non_item": 1,
26
  "review": 3
27
  },
28
+ "layer_norm_eps": 1e-12,
29
  "max_position_embeddings": 512,
30
+ "model_type": "bert",
31
+ "num_attention_heads": 12,
32
+ "num_hidden_layers": 12,
33
+ "pad_token_id": 0,
34
+ "pooler_fc_size": 768,
35
+ "pooler_num_attention_heads": 12,
36
+ "pooler_num_fc_layers": 3,
37
+ "pooler_size_per_head": 128,
38
+ "pooler_type": "first_token_transform",
39
+ "position_embedding_type": "absolute",
40
  "problem_type": "single_label_classification",
 
 
41
  "torch_dtype": "float32",
42
  "transformers_version": "4.32.0",
43
+ "type_vocab_size": 2,
44
+ "use_cache": true,
45
  "vocab_size": 42000
46
  }
pytorch_model.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:5fbf6b79baa3c5a72e3959086ca02b9e0eb96f11a9c6906670bcf808fa3b33c0
3
- size 684546438
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:cfcb16109e2b7036c61479eacd459d8afd92c0812f406927009271be31b7dc60
3
+ size 473270510
special_tokens_map.json CHANGED
@@ -1,9 +1,7 @@
1
  {
2
- "bos_token": "<s>",
3
- "cls_token": "<cls>",
4
- "eos_token": "</s>",
5
- "mask_token": "<mask>",
6
- "pad_token": "<pad>",
7
- "sep_token": "<sep>",
8
- "unk_token": "<unk>"
9
  }
 
1
  {
2
+ "cls_token": "[CLS]",
3
+ "mask_token": "[MASK]",
4
+ "pad_token": "[PAD]",
5
+ "sep_token": "[SEP]",
6
+ "unk_token": "[UNK]"
 
 
7
  }
tokenizer.json CHANGED
@@ -10,7 +10,7 @@
10
  "added_tokens": [
11
  {
12
  "id": 0,
13
- "content": "<pad>",
14
  "single_word": false,
15
  "lstrip": false,
16
  "rstrip": false,
@@ -19,7 +19,7 @@
19
  },
20
  {
21
  "id": 1,
22
- "content": "<unk>",
23
  "single_word": false,
24
  "lstrip": false,
25
  "rstrip": false,
@@ -28,7 +28,7 @@
28
  },
29
  {
30
  "id": 2,
31
- "content": "<cls>",
32
  "single_word": false,
33
  "lstrip": false,
34
  "rstrip": false,
@@ -37,7 +37,7 @@
37
  },
38
  {
39
  "id": 3,
40
- "content": "<sep>",
41
  "single_word": false,
42
  "lstrip": false,
43
  "rstrip": false,
@@ -46,25 +46,7 @@
46
  },
47
  {
48
  "id": 4,
49
- "content": "<mask>",
50
- "single_word": false,
51
- "lstrip": false,
52
- "rstrip": false,
53
- "normalized": false,
54
- "special": true
55
- },
56
- {
57
- "id": 5,
58
- "content": "<s>",
59
- "single_word": false,
60
- "lstrip": false,
61
- "rstrip": false,
62
- "normalized": false,
63
- "special": true
64
- },
65
- {
66
- "id": 6,
67
- "content": "</s>",
68
  "single_word": false,
69
  "lstrip": false,
70
  "rstrip": false,
@@ -87,8 +69,8 @@
87
  "single": [
88
  {
89
  "SpecialToken": {
90
- "id": "<cls>",
91
- "type_id": 2
92
  }
93
  },
94
  {
@@ -99,7 +81,7 @@
99
  },
100
  {
101
  "SpecialToken": {
102
- "id": "<sep>",
103
  "type_id": 0
104
  }
105
  }
@@ -107,8 +89,8 @@
107
  "pair": [
108
  {
109
  "SpecialToken": {
110
- "id": "<cls>",
111
- "type_id": 2
112
  }
113
  },
114
  {
@@ -119,7 +101,7 @@
119
  },
120
  {
121
  "SpecialToken": {
122
- "id": "<sep>",
123
  "type_id": 0
124
  }
125
  },
@@ -131,28 +113,28 @@
131
  },
132
  {
133
  "SpecialToken": {
134
- "id": "<sep>",
135
  "type_id": 1
136
  }
137
  }
138
  ],
139
  "special_tokens": {
140
- "<cls>": {
141
- "id": "<cls>",
142
  "ids": [
143
  2
144
  ],
145
  "tokens": [
146
- "<cls>"
147
  ]
148
  },
149
- "<sep>": {
150
- "id": "<sep>",
151
  "ids": [
152
  3
153
  ],
154
  "tokens": [
155
- "<sep>"
156
  ]
157
  }
158
  }
@@ -164,19 +146,19 @@
164
  },
165
  "model": {
166
  "type": "WordPiece",
167
- "unk_token": "<unk>",
168
  "continuing_subword_prefix": "##",
169
  "max_input_chars_per_word": 100,
170
  "vocab": {
171
- "<pad>": 0,
172
- "<unk>": 1,
173
- "<cls>": 2,
174
- "<sep>": 3,
175
- "<mask>": 4,
176
- "<s>": 5,
177
- "</s>": 6,
178
- "<eod>": 7,
179
- "<eop>": 8,
180
  "[unused4]": 9,
181
  "[unused5]": 10,
182
  "[unused6]": 11,
 
10
  "added_tokens": [
11
  {
12
  "id": 0,
13
+ "content": "[PAD]",
14
  "single_word": false,
15
  "lstrip": false,
16
  "rstrip": false,
 
19
  },
20
  {
21
  "id": 1,
22
+ "content": "[UNK]",
23
  "single_word": false,
24
  "lstrip": false,
25
  "rstrip": false,
 
28
  },
29
  {
30
  "id": 2,
31
+ "content": "[CLS]",
32
  "single_word": false,
33
  "lstrip": false,
34
  "rstrip": false,
 
37
  },
38
  {
39
  "id": 3,
40
+ "content": "[SEP]",
41
  "single_word": false,
42
  "lstrip": false,
43
  "rstrip": false,
 
46
  },
47
  {
48
  "id": 4,
49
+ "content": "[MASK]",
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
50
  "single_word": false,
51
  "lstrip": false,
52
  "rstrip": false,
 
69
  "single": [
70
  {
71
  "SpecialToken": {
72
+ "id": "[CLS]",
73
+ "type_id": 0
74
  }
75
  },
76
  {
 
81
  },
82
  {
83
  "SpecialToken": {
84
+ "id": "[SEP]",
85
  "type_id": 0
86
  }
87
  }
 
89
  "pair": [
90
  {
91
  "SpecialToken": {
92
+ "id": "[CLS]",
93
+ "type_id": 0
94
  }
95
  },
96
  {
 
101
  },
102
  {
103
  "SpecialToken": {
104
+ "id": "[SEP]",
105
  "type_id": 0
106
  }
107
  },
 
113
  },
114
  {
115
  "SpecialToken": {
116
+ "id": "[SEP]",
117
  "type_id": 1
118
  }
119
  }
120
  ],
121
  "special_tokens": {
122
+ "[CLS]": {
123
+ "id": "[CLS]",
124
  "ids": [
125
  2
126
  ],
127
  "tokens": [
128
+ "[CLS]"
129
  ]
130
  },
131
+ "[SEP]": {
132
+ "id": "[SEP]",
133
  "ids": [
134
  3
135
  ],
136
  "tokens": [
137
+ "[SEP]"
138
  ]
139
  }
140
  }
 
146
  },
147
  "model": {
148
  "type": "WordPiece",
149
+ "unk_token": "[UNK]",
150
  "continuing_subword_prefix": "##",
151
  "max_input_chars_per_word": 100,
152
  "vocab": {
153
+ "[PAD]": 0,
154
+ "[UNK]": 1,
155
+ "[CLS]": 2,
156
+ "[SEP]": 3,
157
+ "[MASK]": 4,
158
+ "[unused0]": 5,
159
+ "[unused1]": 6,
160
+ "[unused2]": 7,
161
+ "[unused3]": 8,
162
  "[unused4]": 9,
163
  "[unused5]": 10,
164
  "[unused6]": 11,
tokenizer_config.json CHANGED
@@ -1,19 +1,15 @@
1
  {
2
- "bos_token": "<s>",
3
- "clean_text": true,
4
  "clean_up_tokenization_spaces": true,
5
- "cls_token": "<cls>",
6
  "do_basic_tokenize": true,
7
  "do_lower_case": true,
8
- "eos_token": "</s>",
9
- "mask_token": "<mask>",
10
  "model_max_length": 512,
11
  "never_split": null,
12
- "pad_token": "<pad>",
13
- "sep_token": "<sep>",
14
  "strip_accents": false,
15
  "tokenize_chinese_chars": true,
16
- "tokenizer_class": "FunnelTokenizer",
17
- "unk_token": "<unk>",
18
- "wordpieces_prefix": "##"
19
  }
 
1
  {
 
 
2
  "clean_up_tokenization_spaces": true,
3
+ "cls_token": "[CLS]",
4
  "do_basic_tokenize": true,
5
  "do_lower_case": true,
6
+ "mask_token": "[MASK]",
 
7
  "model_max_length": 512,
8
  "never_split": null,
9
+ "pad_token": "[PAD]",
10
+ "sep_token": "[SEP]",
11
  "strip_accents": false,
12
  "tokenize_chinese_chars": true,
13
+ "tokenizer_class": "BertTokenizer",
14
+ "unk_token": "[UNK]"
 
15
  }
training_args.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:5d9a5a04723c7b140f278b33665efcfdaa8934f2abd07e0d4349157e35f33bb1
3
  size 4472
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ba5c275c0bb7447c906e5ea04738c5d9ea5a84e1e3000af05de39d43a8eaacef
3
  size 4472
vocab.txt CHANGED
@@ -1,12 +1,12 @@
1
- <pad>
2
- <unk>
3
- <cls>
4
- <sep>
5
- <mask>
6
- <s>
7
- </s>
8
- <eod>
9
- <eop>
10
  [unused4]
11
  [unused5]
12
  [unused6]
 
1
+ [PAD]
2
+ [UNK]
3
+ [CLS]
4
+ [SEP]
5
+ [MASK]
6
+ [unused0]
7
+ [unused1]
8
+ [unused2]
9
+ [unused3]
10
  [unused4]
11
  [unused5]
12
  [unused6]