chipherndon commited on
Commit
9e31685
·
verified ·
1 Parent(s): 4368c9c

Patch tokenizer_class TokenizersBackend -> Qwen2Tokenizer for vLLM/transformers 4.x

Browse files
Files changed (1) hide show
  1. tokenizer_config.json +23 -23
tokenizer_config.json CHANGED
@@ -1,32 +1,32 @@
1
  {
2
- "add_prefix_space": false,
3
- "audio_bos_token": "<|audio_start|>",
4
- "audio_eos_token": "<|audio_end|>",
5
- "audio_token": "<|audio_pad|>",
6
- "backend": "tokenizers",
7
- "bos_token": null,
8
- "clean_up_tokenization_spaces": false,
9
- "eos_token": "<|im_end|>",
10
- "errors": "replace",
11
- "image_token": "<|image_pad|>",
12
- "is_local": true,
13
- "model_max_length": 262144,
14
- "model_specific_special_tokens": {
15
  "audio_bos_token": "<|audio_start|>",
16
  "audio_eos_token": "<|audio_end|>",
17
  "audio_token": "<|audio_pad|>",
 
 
 
 
 
18
  "image_token": "<|image_pad|>",
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
19
  "video_token": "<|video_pad|>",
20
  "vision_bos_token": "<|vision_start|>",
21
  "vision_eos_token": "<|vision_end|>"
22
- },
23
- "pad_token": "<|endoftext|>",
24
- "pretokenize_regex": "(?i:'s|'t|'re|'ve|'m|'ll|'d)|[^\\r\\n\\p{L}\\p{N}]?[\\p{L}\\p{M}]+|\\p{N}| ?[^\\s\\p{L}\\p{M}\\p{N}]+[\\r\\n]*|\\s*[\\r\\n]+|\\s+(?!\\S)|\\s+",
25
- "processor_class": "Qwen3VLProcessor",
26
- "split_special_tokens": false,
27
- "tokenizer_class": "TokenizersBackend",
28
- "unk_token": null,
29
- "video_token": "<|video_pad|>",
30
- "vision_bos_token": "<|vision_start|>",
31
- "vision_eos_token": "<|vision_end|>"
32
  }
 
1
  {
2
+ "add_prefix_space": false,
 
 
 
 
 
 
 
 
 
 
 
 
3
  "audio_bos_token": "<|audio_start|>",
4
  "audio_eos_token": "<|audio_end|>",
5
  "audio_token": "<|audio_pad|>",
6
+ "backend": "tokenizers",
7
+ "bos_token": null,
8
+ "clean_up_tokenization_spaces": false,
9
+ "eos_token": "<|im_end|>",
10
+ "errors": "replace",
11
  "image_token": "<|image_pad|>",
12
+ "is_local": true,
13
+ "model_max_length": 262144,
14
+ "model_specific_special_tokens": {
15
+ "audio_bos_token": "<|audio_start|>",
16
+ "audio_eos_token": "<|audio_end|>",
17
+ "audio_token": "<|audio_pad|>",
18
+ "image_token": "<|image_pad|>",
19
+ "video_token": "<|video_pad|>",
20
+ "vision_bos_token": "<|vision_start|>",
21
+ "vision_eos_token": "<|vision_end|>"
22
+ },
23
+ "pad_token": "<|endoftext|>",
24
+ "pretokenize_regex": "(?i:'s|'t|'re|'ve|'m|'ll|'d)|[^\\r\\n\\p{L}\\p{N}]?[\\p{L}\\p{M}]+|\\p{N}| ?[^\\s\\p{L}\\p{M}\\p{N}]+[\\r\\n]*|\\s*[\\r\\n]+|\\s+(?!\\S)|\\s+",
25
+ "processor_class": "Qwen3VLProcessor",
26
+ "split_special_tokens": false,
27
+ "tokenizer_class": "Qwen2Tokenizer",
28
+ "unk_token": null,
29
  "video_token": "<|video_pad|>",
30
  "vision_bos_token": "<|vision_start|>",
31
  "vision_eos_token": "<|vision_end|>"
 
 
 
 
 
 
 
 
 
 
32
  }