Upload tokenizer

Files changed (4) hide show

added_tokens.json CHANGED Viewed

@@ -1,7 +1,3 @@
 {
-  "</D>": 28998,
-  "</P>": 29000,
-  "<D>": 28997,
-  "<N>": 28996,
-  "<P>": 28999
 }

 {
+  "<N>": 28996
 }

special_tokens_map.json CHANGED Viewed

@@ -6,34 +6,6 @@
       "normalized": false,
       "rstrip": false,
       "single_word": false
-    },
-    {
-      "content": "<D>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false
-    },
-    {
-      "content": "</D>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false
-    },
-    {
-      "content": "<P>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false
-    },
-    {
-      "content": "</P>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false
     }
   ],
   "cls_token": "[CLS]",

       "normalized": false,
       "rstrip": false,
       "single_word": false
     }
   ],
   "cls_token": "[CLS]",

tokenizer.json CHANGED Viewed

@@ -56,42 +56,6 @@
       "rstrip": false,
       "normalized": false,
       "special": true
-    },
-    {
-      "id": 28997,
-      "content": "<D>",
-      "single_word": false,
-      "lstrip": false,
-      "rstrip": false,
-      "normalized": false,
-      "special": true
-    },
-    {
-      "id": 28998,
-      "content": "</D>",
-      "single_word": false,
-      "lstrip": false,
-      "rstrip": false,
-      "normalized": false,
-      "special": true
-    },
-    {
-      "id": 28999,
-      "content": "<P>",
-      "single_word": false,
-      "lstrip": false,
-      "rstrip": false,
-      "normalized": false,
-      "special": true
-    },
-    {
-      "id": 29000,
-      "content": "</P>",
-      "single_word": false,
-      "lstrip": false,
-      "rstrip": false,
-      "normalized": false,
-      "special": true
     }
   ],
   "normalizer": {

       "rstrip": false,
       "normalized": false,
       "special": true
     }
   ],
   "normalizer": {

tokenizer_config.json CHANGED Viewed

@@ -47,46 +47,10 @@
       "rstrip": false,
       "single_word": false,
       "special": true
-    },
-    "28997": {
-      "content": "<D>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false,
-      "special": true
-    },
-    "28998": {
-      "content": "</D>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false,
-      "special": true
-    },
-    "28999": {
-      "content": "<P>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false,
-      "special": true
-    },
-    "29000": {
-      "content": "</P>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false,
-      "special": true
     }
   },
   "additional_special_tokens": [
-    "<N>",
-    "<D>",
-    "</D>",
-    "<P>",
-    "</P>"
   ],
   "clean_up_tokenization_spaces": true,
   "cls_token": "[CLS]",

       "rstrip": false,
       "single_word": false,
       "special": true
     }
   },
   "additional_special_tokens": [
+    "<N>"
   ],
   "clean_up_tokenization_spaces": true,
   "cls_token": "[CLS]",