hf-transformers-bot commited on
Commit
fd57f74
·
verified ·
1 Parent(s): 265c6a3

Update tiny models for GlmImageTextModel

Browse files
.gitattributes CHANGED
@@ -33,3 +33,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
 
 
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ tokenizer.json filter=lfs diff=lfs merge=lfs -text
chat_template.jinja ADDED
@@ -0,0 +1,13 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {%- for m in messages -%}
2
+ {%- if m.content is string -%}
3
+ {{ m.content }}
4
+ {%- else -%}
5
+ {%- for item in m.content -%}
6
+ {%- if item.type == 'image' or item.get('image') is not none -%}
7
+ <|dit_token_16384|><|image|><|dit_token_16385|>
8
+ {%- elif item.type == 'text' -%}
9
+ {{ item.text }}
10
+ {%- endif -%}
11
+ {%- endfor -%}
12
+ {%- endif -%}
13
+ {%- endfor -%}
config.json ADDED
@@ -0,0 +1,42 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "architectures": [
3
+ "GlmImageTextModel"
4
+ ],
5
+ "attention_bias": true,
6
+ "attention_dropout": 0.0,
7
+ "bos_token_id": 16384,
8
+ "dtype": "float32",
9
+ "eos_token_id": 16385,
10
+ "hidden_act": "silu",
11
+ "hidden_size": 16,
12
+ "initializer_range": 0.02,
13
+ "intermediate_size": 22,
14
+ "max_position_embeddings": 512,
15
+ "model_type": "glm_image_text",
16
+ "n_group": 1,
17
+ "n_routed_experts": 8,
18
+ "n_shared_experts": 1,
19
+ "num_attention_heads": 2,
20
+ "num_experts_per_tok": 8,
21
+ "num_hidden_layers": 2,
22
+ "num_key_value_heads": 1,
23
+ "output_channels": 64,
24
+ "pad_token_id": 16385,
25
+ "rms_norm_eps": 1e-05,
26
+ "rope_parameters": {
27
+ "mrope_section": [
28
+ 2,
29
+ 1,
30
+ 1
31
+ ],
32
+ "rope_theta": 10000,
33
+ "rope_type": "default",
34
+ "type": "default"
35
+ },
36
+ "tie_word_embeddings": true,
37
+ "topk_group": 1,
38
+ "transformers_version": "5.16.0.dev0",
39
+ "use_cache": true,
40
+ "vision_vocab_size": 99,
41
+ "vocab_size": 167864
42
+ }
model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:74fa56c8881d83723cd57307138db3e4b0e60ca8fa531c7e6872cf5a7114a237
3
+ size 10761544
preprocessor_config.json ADDED
@@ -0,0 +1,26 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "do_convert_rgb": true,
3
+ "do_normalize": true,
4
+ "do_rescale": true,
5
+ "do_resize": true,
6
+ "image_mean": [
7
+ 0.5,
8
+ 0.5,
9
+ 0.5
10
+ ],
11
+ "image_processor_type": "GlmImageImageProcessor",
12
+ "image_std": [
13
+ 0.5,
14
+ 0.5,
15
+ 0.5
16
+ ],
17
+ "merge_size": 1,
18
+ "patch_size": 16,
19
+ "resample": 3,
20
+ "rescale_factor": 0.00392156862745098,
21
+ "size": {
22
+ "longest_edge": 4194304,
23
+ "shortest_edge": 262144
24
+ },
25
+ "temporal_patch_size": 1
26
+ }
tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d771c9659fd2c65c0ef8a8daf9d9f9f07b53f89ce164cc832a28137db604d01d
3
+ size 23765636
tokenizer_config.json ADDED
@@ -0,0 +1,44 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "backend": "tokenizers",
3
+ "bos_token": "<|dit_token_16384|>",
4
+ "clean_up_tokenization_spaces": false,
5
+ "do_lower_case": false,
6
+ "eos_token": "<|dit_token_16385|>",
7
+ "extra_special_tokens": [
8
+ "<|endoftext|>",
9
+ "[MASK]",
10
+ "[gMASK]",
11
+ "[sMASK]",
12
+ "<sop>",
13
+ "<eop>",
14
+ "<|system|>",
15
+ "<|user|>",
16
+ "<|assistant|>",
17
+ "<|observation|>",
18
+ "<|begin_of_image|>",
19
+ "<|end_of_image|>",
20
+ "<|begin_of_video|>",
21
+ "<|end_of_video|>",
22
+ "<|image|>",
23
+ "<|video|>"
24
+ ],
25
+ "grid_bos_token": "<sop>",
26
+ "grid_eos_token": "<eop>",
27
+ "image_token": "<|image|>",
28
+ "is_local": true,
29
+ "local_files_only": false,
30
+ "model_input_names": [
31
+ "input_ids",
32
+ "attention_mask"
33
+ ],
34
+ "model_max_length": 512,
35
+ "model_specific_special_tokens": {
36
+ "grid_bos_token": "<sop>",
37
+ "grid_eos_token": "<eop>",
38
+ "image_token": "<|image|>"
39
+ },
40
+ "pad_token": "<|dit_token_16385|>",
41
+ "padding_side": "left",
42
+ "remove_space": false,
43
+ "tokenizer_class": "TokenizersBackend"
44
+ }