HeyDunaX commited on
Commit
7f088fa
·
verified ·
1 Parent(s): 22400cc

upload tokenizer_config.json

Browse files
Files changed (1) hide show
  1. tokenizer_config.json +11 -0
tokenizer_config.json ADDED
@@ -0,0 +1,11 @@
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "tokenizer_class": "MorphemeTokenizer",
3
+ "model_type": "splade",
4
+ "vocab_size": 56961,
5
+ "max_length": 128,
6
+ "do_lower_case": false,
7
+ "seg_temp_train": 1.0,
8
+ "seg_temp_eval": 0.0,
9
+ "min_freq_word": 2,
10
+ "min_freq_morph": 3
11
+ }