weepiess2383 commited on
Commit
3428eb7
·
verified ·
1 Parent(s): c72fe85

add lafm_vla_flow_neo2b_fulllayer_libero_fullft_m323_flft0815r/config.yaml

Browse files
lafm_vla_flow_neo2b_fulllayer_libero_fullft_m323_flft0815r/config.yaml ADDED
@@ -0,0 +1,243 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ output_dir: /mnt/afs/multimodal_data/fanweichen/experiments
2
+ train_split: 0.9
3
+ img_size: 224
4
+ patch_size: 14
5
+ encoder_scale: tiny
6
+ dump_object: true
7
+ num_workers: 8
8
+ seed: 42
9
+ log_every: 20
10
+ trainer:
11
+ max_epochs: 1
12
+ max_steps: 30000
13
+ devices: auto
14
+ accelerator: gpu
15
+ strategy: ddp
16
+ precision: bf16
17
+ gradient_accumulation_steps: 4
18
+ gradient_clip_val: 1.0
19
+ save_every: 2500
20
+ save_final: true
21
+ overfit_first_batch: false
22
+ num_sanity_val_steps: 0
23
+ sync_batchnorm: false
24
+ loader:
25
+ batch_size: 8
26
+ num_workers: 8
27
+ persistent_workers: true
28
+ prefetch_factor: 4
29
+ pin_memory: true
30
+ optimizer:
31
+ type: AdamW
32
+ lr: ${learning_rate}
33
+ weight_decay: ${weight_decay}
34
+ wandb:
35
+ enabled: false
36
+ config:
37
+ entity: weepies
38
+ project: lewm
39
+ name: ${output_model_name}
40
+ id: ${subdir}
41
+ resume: allow
42
+ log_model: false
43
+ wm:
44
+ history_size: 1
45
+ num_preds: 8
46
+ embed_dim: 2048
47
+ type: lafm_vla_flow
48
+ action_dim: 7
49
+ proprio_dim: 8
50
+ data:
51
+ train:
52
+ _target_: data.lerobot.robot_video_dataset.RobotVideoDataset
53
+ dataset_dirs:
54
+ - downloads/FastWAM/data/libero_m323_rs141_256/libero_spatial_no_noops_lerobot
55
+ - downloads/FastWAM/data/libero_m323_rs141_256/libero_object_no_noops_lerobot
56
+ - downloads/FastWAM/data/libero_m323_rs141_256/libero_goal_no_noops_lerobot
57
+ - downloads/FastWAM/data/libero_m323_rs141_256/libero_10_no_noops_lerobot
58
+ shape_meta:
59
+ images:
60
+ - key: image
61
+ raw_shape:
62
+ - 3
63
+ - 256
64
+ - 256
65
+ shape:
66
+ - 3
67
+ - 256
68
+ - 256
69
+ - key: wrist_image
70
+ raw_shape:
71
+ - 3
72
+ - 256
73
+ - 256
74
+ shape:
75
+ - 3
76
+ - 256
77
+ - 256
78
+ action:
79
+ - key: default
80
+ raw_shape: 7
81
+ shape: 7
82
+ state:
83
+ - key: default
84
+ raw_shape: 8
85
+ shape: 8
86
+ num_frames: 9
87
+ global_sample_stride: 1
88
+ action_video_freq_ratio: 2
89
+ video_size:
90
+ - 256
91
+ - 512
92
+ camera_key: null
93
+ val_set_proportion: 0.0
94
+ is_training_set: true
95
+ skip_padding_as_possible: true
96
+ concat_multi_camera: horizontal
97
+ image_current_frame_only: true
98
+ fast_arrow_read: true
99
+ prewarm_page_cache: true
100
+ processor:
101
+ _target_: data.lerobot.processors.fastwam_processor.FastWAMProcessor
102
+ shape_meta: ${data.train.shape_meta}
103
+ num_obs_steps: ${data.train.num_frames}
104
+ image_obs_steps: 1
105
+ num_output_cameras: 2
106
+ action_output_dim: 7
107
+ proprio_output_dim: 8
108
+ delta_action_dim_mask:
109
+ default:
110
+ - true
111
+ - true
112
+ - true
113
+ - true
114
+ - true
115
+ - true
116
+ - false
117
+ action_state_transforms: null
118
+ use_stepwise_action_norm: false
119
+ norm_default_mode: -1/1
120
+ norm_exception_mode: null
121
+ action_state_merger:
122
+ _target_: data.lerobot.transforms.action_state_merger.ConcatLeftAlign
123
+ train_transforms:
124
+ - _target_: data.lerobot.transforms.image.ToTensor
125
+ - _target_: torchvision.transforms.Resize
126
+ size:
127
+ - 256
128
+ - 256
129
+ val_transforms:
130
+ - _target_: data.lerobot.transforms.image.ToTensor
131
+ - _target_: torchvision.transforms.Resize
132
+ size:
133
+ - 256
134
+ - 256
135
+ text_embedding_cache_dir: ${oc.env:LAFM_LIBERO_TEXT_CACHE,downloads/FastWAM/data/text_embeds_cache/libero}
136
+ context_len: 128
137
+ pretrained_norm_stats: ${oc.env:LAFM_OXE_NORM_STATS,downloads/openvla_oxe_lerobot/dataset_stats.json}
138
+ per_dataset_action_norm: true
139
+ per_dataset_norm_stats_dir: downloads/FastWAM/data/libero_m323_rs141_256/_per_dataset_stats_merged
140
+ action_norm_mask:
141
+ - true
142
+ - true
143
+ - true
144
+ - true
145
+ - true
146
+ - true
147
+ - false
148
+ dataset_weight_sampling: true
149
+ dataset_weights:
150
+ libero_spatial_no_noops_lerobot: 1.0
151
+ libero_object_no_noops_lerobot: 1.0
152
+ libero_goal_no_noops_lerobot: 1.0
153
+ libero_10_no_noops_lerobot: 1.0
154
+ method: lafm_flow_fullft_skip_mem
155
+ output_model_name: lafm_vla_flow_neo2b_fulllayer_libero_fullft_m323
156
+ subdir: lafm_vla_flow_neo2b_fulllayer_libero_fullft_m323_flft0815r
157
+ save_note: 'LIBERO 4-suite FULL finetune of fulllayer-bb (FULL-LAYER 40/40 layer-map
158
+ ablation, 4096x75k pretrain @75k) (NEO VLM unfrozen; no grad-dead backbone tail
159
+ under the 0..39 map, stock last-layer/final-norm freeze only). [m323_rs141_256 data:
160
+ mujoco 3.2.3 + robosuite 1.4.1 regen, 256-native]'
161
+ mixed_precision: bf16
162
+ learning_rate: 5.0e-05
163
+ weight_decay: 0.0
164
+ batch_size: 8
165
+ model:
166
+ architecture: lafm_vla_flow
167
+ backbone_type: neo_frozen
168
+ neo_model_path: /mnt/afs/diaohaiwen/workspace/Neo/Neo_dense/RUN/NEOpp-2B-SFT
169
+ local_files_only: true
170
+ image_size: 256
171
+ max_text_tokens: 128
172
+ max_views: 2
173
+ chunk_K: 8
174
+ init_from: /mnt/afs/multimodal_data/fanweichen/experiments/lafm_vla_flow_neo2b_fulllayer_bb_bb_flbb_0813a/lafm_vla_flow_neo2b_fulllayer_bb_bb_weights.ckpt.shards.step000075000
175
+ init_use_ema: true
176
+ init_full_cover: false
177
+ aug:
178
+ enabled: true
179
+ crop_frac: 0.95
180
+ rot_deg: 5.0
181
+ jitter:
182
+ - 0.3
183
+ - 0.4
184
+ - 0.5
185
+ jitter_p: 0.5
186
+ expert:
187
+ width: 1024
188
+ intermediate: 3072
189
+ init_std: 0.02
190
+ qk_norm_calibration: true
191
+ layer_map:
192
+ - 0
193
+ - 1
194
+ - 2
195
+ - 3
196
+ - 4
197
+ - 5
198
+ - 6
199
+ - 7
200
+ - 8
201
+ - 9
202
+ - 10
203
+ - 11
204
+ - 12
205
+ - 13
206
+ - 14
207
+ - 15
208
+ - 16
209
+ - 17
210
+ - 18
211
+ - 19
212
+ - 20
213
+ - 21
214
+ - 22
215
+ - 23
216
+ - 24
217
+ - 25
218
+ - 26
219
+ - 27
220
+ - 28
221
+ - 29
222
+ - 30
223
+ - 31
224
+ - 32
225
+ - 33
226
+ - 34
227
+ - 35
228
+ - 36
229
+ - 37
230
+ - 38
231
+ - 39
232
+ flow:
233
+ num_steps: 10
234
+ adam_betas:
235
+ - 0.9
236
+ - 0.95
237
+ adam_eps: 1.0e-08
238
+ adam_weight_decay: 1.0e-10
239
+ warmup_steps: 2000
240
+ lr_final: 5.0e-06
241
+ ema_decay: 0.999
242
+ eval_every: 4000
243
+ sample_eval_every: 8000