dangvansam commited on
Commit
682c199
·
verified ·
1 Parent(s): a8c6a82

v2: fine-tune from uitnlp/visobert (VN-native backbone) - beats v1 on every threshold

Browse files
config.json CHANGED
@@ -7,7 +7,6 @@
7
  "classifier_dropout": null,
8
  "dtype": "float32",
9
  "eos_token_id": 2,
10
- "gradient_checkpointing": false,
11
  "hidden_act": "gelu",
12
  "hidden_dropout_prob": 0.1,
13
  "hidden_size": 768,
@@ -19,16 +18,15 @@
19
  "label2id": {
20
  "toxicity": 0
21
  },
22
- "layer_norm_eps": 1e-05,
23
  "max_position_embeddings": 514,
24
  "model_type": "xlm-roberta",
25
  "num_attention_heads": 12,
26
  "num_hidden_layers": 12,
27
- "output_past": true,
28
  "pad_token_id": 1,
29
  "position_embedding_type": "absolute",
30
  "transformers_version": "4.57.6",
31
- "type_vocab_size": 1,
32
  "use_cache": true,
33
- "vocab_size": 250002
34
  }
 
7
  "classifier_dropout": null,
8
  "dtype": "float32",
9
  "eos_token_id": 2,
 
10
  "hidden_act": "gelu",
11
  "hidden_dropout_prob": 0.1,
12
  "hidden_size": 768,
 
18
  "label2id": {
19
  "toxicity": 0
20
  },
21
+ "layer_norm_eps": 1e-12,
22
  "max_position_embeddings": 514,
23
  "model_type": "xlm-roberta",
24
  "num_attention_heads": 12,
25
  "num_hidden_layers": 12,
 
26
  "pad_token_id": 1,
27
  "position_embedding_type": "absolute",
28
  "transformers_version": "4.57.6",
29
+ "type_vocab_size": 2,
30
  "use_cache": true,
31
+ "vocab_size": 15004
32
  }
model.onnx CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:702345594e99d01bf3deb6697a1990ebaf41783352a0e08572bab94acfcb158f
3
- size 1112400634
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:954b3ef745a76293713486f55d723c0277ae86c8354369856473bb91e7156924
3
+ size 390489847
sentencepiece.bpe.model CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:cfc8146abe2a0488e9e2a0c56de7952f7c11ab059eca145a0a727afce0db2865
3
- size 5069051
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:02aaf05cda4db99e86b7c76eba6258867ce4d043da0fed19c87a7d46c8b53a65
3
+ size 470732
tokenizer.json CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:b05d40e5344b7ebcd126146d4a0e66b5ea9a639ab84a2eafc109aabab25dc9ef
3
- size 17098349
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3feb78081252fc85422f95a0a0284b6a03cc3522d0dbbcb2c86f2c15c3e5f0c8
3
+ size 1802897
tokenizer_config.json CHANGED
@@ -32,7 +32,7 @@
32
  "single_word": false,
33
  "special": true
34
  },
35
- "250001": {
36
  "content": "<mask>",
37
  "lstrip": true,
38
  "normalized": false,
@@ -47,7 +47,7 @@
47
  "eos_token": "</s>",
48
  "extra_special_tokens": {},
49
  "mask_token": "<mask>",
50
- "model_max_length": 512,
51
  "pad_token": "<pad>",
52
  "sep_token": "</s>",
53
  "sp_model_kwargs": {},
 
32
  "single_word": false,
33
  "special": true
34
  },
35
+ "15001": {
36
  "content": "<mask>",
37
  "lstrip": true,
38
  "normalized": false,
 
47
  "eos_token": "</s>",
48
  "extra_special_tokens": {},
49
  "mask_token": "<mask>",
50
+ "model_max_length": 1000000000000000019884624838656,
51
  "pad_token": "<pad>",
52
  "sep_token": "</s>",
53
  "sp_model_kwargs": {},