Robotics
LeRobot
Safetensors
smolvla
callmeeric5 commited on
Commit
87fc3c0
·
verified ·
1 Parent(s): d581405

Upload DataProcessorPipeline

Browse files
policy_preprocessor.json ADDED
@@ -0,0 +1,82 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "name": "policy_preprocessor",
3
+ "steps": [
4
+ {
5
+ "registry_name": "rename_observations_processor",
6
+ "config": {
7
+ "rename_map": {}
8
+ }
9
+ },
10
+ {
11
+ "registry_name": "to_batch_processor",
12
+ "config": {}
13
+ },
14
+ {
15
+ "registry_name": "smolvla_new_line_processor",
16
+ "config": {}
17
+ },
18
+ {
19
+ "registry_name": "tokenizer_processor",
20
+ "config": {
21
+ "max_length": 48,
22
+ "task_key": "task",
23
+ "padding_side": "right",
24
+ "padding": "longest",
25
+ "truncation": true,
26
+ "tokenizer_name": "tokenizer"
27
+ },
28
+ "artifacts": {
29
+ "tokenizer_name": "tokenizer"
30
+ }
31
+ },
32
+ {
33
+ "registry_name": "device_processor",
34
+ "config": {
35
+ "device": "cuda",
36
+ "float_dtype": null
37
+ }
38
+ },
39
+ {
40
+ "registry_name": "normalizer_processor",
41
+ "config": {
42
+ "eps": 1e-08,
43
+ "features": {
44
+ "observation.state": {
45
+ "type": "STATE",
46
+ "shape": [
47
+ 6
48
+ ]
49
+ },
50
+ "observation.images.front": {
51
+ "type": "VISUAL",
52
+ "shape": [
53
+ 3,
54
+ 480,
55
+ 640
56
+ ]
57
+ },
58
+ "observation.images.phone": {
59
+ "type": "VISUAL",
60
+ "shape": [
61
+ 3,
62
+ 480,
63
+ 640
64
+ ]
65
+ },
66
+ "action": {
67
+ "type": "ACTION",
68
+ "shape": [
69
+ 6
70
+ ]
71
+ }
72
+ },
73
+ "norm_map": {
74
+ "VISUAL": "IDENTITY",
75
+ "STATE": "MEAN_STD",
76
+ "ACTION": "MEAN_STD"
77
+ }
78
+ },
79
+ "state_file": "policy_preprocessor_step_5_normalizer_processor.safetensors"
80
+ }
81
+ ]
82
+ }
policy_preprocessor_step_5_normalizer_processor.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:7cb88b412d7e99e6ee5bf499bb9212362cc5e023a765c259af2a04cf4a734345
3
+ size 7560
tokenizer/chat_template.jinja ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ <|im_start|>{% for message in messages %}{{message['role'] | capitalize}}{% if message['content'][0]['type'] == 'image' %}{{':'}}{% else %}{{': '}}{% endif %}{% for line in message['content'] %}{% if line['type'] == 'text' %}{{line['text']}}{% elif line['type'] == 'image' %}{{ '<image>' }}{% endif %}{% endfor %}<end_of_utterance>
2
+ {% endfor %}{% if add_generation_prompt %}{{ 'Assistant:' }}{% endif %}
tokenizer/tokenizer.json ADDED
The diff for this file is too large to render. See raw diff
 
tokenizer/tokenizer_config.json ADDED
@@ -0,0 +1,27 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "add_prefix_space": false,
3
+ "backend": "tokenizers",
4
+ "bos_token": "<|im_start|>",
5
+ "clean_up_tokenization_spaces": false,
6
+ "end_of_utterance_token": "<end_of_utterance>",
7
+ "eos_token": "<end_of_utterance>",
8
+ "errors": "replace",
9
+ "fake_image_token": "<fake_token_around_image>",
10
+ "global_image_token": "<global-img>",
11
+ "image_token": "<image>",
12
+ "is_local": false,
13
+ "legacy": false,
14
+ "model_max_length": 8192,
15
+ "model_specific_special_tokens": {
16
+ "end_of_utterance_token": "<end_of_utterance>",
17
+ "fake_image_token": "<fake_token_around_image>",
18
+ "global_image_token": "<global-img>",
19
+ "image_token": "<image>"
20
+ },
21
+ "pad_token": "<|im_end|>",
22
+ "processor_class": "SmolVLMProcessor",
23
+ "tokenizer_class": "GPT2Tokenizer",
24
+ "truncation_side": "left",
25
+ "unk_token": "<|endoftext|>",
26
+ "vocab_size": 49152
27
+ }