JasonYang66 commited on
Commit
51b95fc
·
verified ·
1 Parent(s): 29a4829

Add files using upload-large-folder tool

Browse files
config.yaml ADDED
@@ -0,0 +1,54 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ datasets:
2
+ vla_data:
3
+ action_mode: abs
4
+ data_mix: robotwin_clean_32
5
+ data_root_dir: /project/vonneumann1/sqyang/project/EM-LLaVA/starVLA/playground/Datasets/RoboTwin-Clean
6
+ dataset_py: lerobot_datasets
7
+ image_size:
8
+ - 224
9
+ - 224
10
+ per_device_batch_size: 16
11
+ sequential_step_sampling: false
12
+ video_backend: pyav
13
+ framework:
14
+ action_model:
15
+ action_dim: 14
16
+ action_hidden_dim: 2560
17
+ action_model_type: DiT-B
18
+ future_action_window_size: 31
19
+ past_action_window_size: 0
20
+ name: QwenOFT
21
+ qwenvl:
22
+ base_vlm: /project/vonneumann1/sqyang/project/EM-LLaVA/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
23
+ output_dir: /project/vonneumann1/sqyang/project/EM-LLaVA/starVLA/results/Checkpoints/0328robotwin_from_robocoin_1x100k_qwenonly_randomaction_horizon32_frombalance_WM2
24
+ run_id: 0328robotwin_from_robocoin_1x100k_qwenonly_randomaction_horizon32_frombalance_WM2
25
+ run_root_dir: /project/vonneumann1/sqyang/project/EM-LLaVA/starVLA/results/Checkpoints
26
+ seed: 42
27
+ trainer:
28
+ enable_gradient_checkpointing: true
29
+ eval_interval: 1000
30
+ freeze_modules: true
31
+ gradient_accumulation_steps: 1
32
+ gradient_clipping: 1.0
33
+ is_resume: false
34
+ learning_rate:
35
+ action_model: 0.0001
36
+ base: 1.0e-05
37
+ qwen_vl_interface: 1.0e-05
38
+ logging_frequency: 100
39
+ lr_scheduler_type: cosine_with_min_lr
40
+ max_train_steps: 50000
41
+ num_warmup_steps: 5000
42
+ optimizer:
43
+ betas:
44
+ - 0.9
45
+ - 0.95
46
+ eps: 1.0e-08
47
+ weight_decay: 1.0e-08
48
+ pretrained_checkpoint: /project/vonneumann1/sqyang/project/EM-LLaVA/starVLA/results/Checkpoints/0330_robocoin_sq_all_qwen3OFT_WorldModelV2_freezeVisionLLMHalf_balanceDataset/checkpoints/steps_90000_pytorch_model.pt
49
+ reload_modules: qwen_vl_interface
50
+ save_interval: 10000
51
+ scheduler_specific_kwargs:
52
+ min_lr: 5.0e-07
53
+ wandb_entity: yangsenqiao
54
+ wandb_project: EM-LLaVA
dataset_statistics.json ADDED
@@ -0,0 +1,218 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "new_embodiment": {
3
+ "action": {
4
+ "mean": [
5
+ -0.21901101492345337,
6
+ 1.0504990947246553,
7
+ 0.7661802005767822,
8
+ -0.3331204185634851,
9
+ 0.06365180747252454,
10
+ -0.06979782831855118,
11
+ 0.23065026089549062,
12
+ 1.1413198339939117,
13
+ 0.8520238375663758,
14
+ -0.3788263291306793,
15
+ -0.025514634509745525,
16
+ 0.04028999065980314,
17
+ 0.6806974941492078,
18
+ 0.6566390764713288
19
+ ],
20
+ "std": [
21
+ 0.3882080026926371,
22
+ 0.9962431978470905,
23
+ 0.7826509819359658,
24
+ 0.6701073679280808,
25
+ 0.25934216358594864,
26
+ 0.6261345167669774,
27
+ 0.3245623193152152,
28
+ 1.0132390536926115,
29
+ 0.8113444755250797,
30
+ 0.7242207074420685,
31
+ 0.26989906331402447,
32
+ 0.6765045276556505,
33
+ 0.4472407649627974,
34
+ 0.45477049309587164
35
+ ],
36
+ "max": [
37
+ 5.681515216827393,
38
+ 3.8880207538604736,
39
+ 4.500889301300049,
40
+ 1.789766788482666,
41
+ 1.5632697343826294,
42
+ 4.389739513397217,
43
+ 1.3892723321914673,
44
+ 3.242604970932007,
45
+ 3.6588551998138428,
46
+ 1.9530924558639526,
47
+ 1.397123098373413,
48
+ 3.503765106201172,
49
+ 1.0,
50
+ 1.0
51
+ ],
52
+ "min": [
53
+ -7.340834140777588,
54
+ -0.0003164021181873977,
55
+ -0.1190902441740036,
56
+ -1.9268131256103516,
57
+ -1.4216828346252441,
58
+ -6.232340335845947,
59
+ -6.316576957702637,
60
+ -0.5742834806442261,
61
+ -0.005311839282512665,
62
+ -1.9893786907196045,
63
+ -2.1285502910614014,
64
+ -6.269529342651367,
65
+ 0.0,
66
+ 0.0
67
+ ],
68
+ "q01": [
69
+ -7.334665780067444,
70
+ -5.257390398583084e-07,
71
+ -2.2967718905420043e-05,
72
+ -1.841589093208313,
73
+ -1.1798312604427337,
74
+ -5.643983192443847,
75
+ -5.995517673492431,
76
+ -0.36572347044944764,
77
+ -2.81171942333458e-05,
78
+ -1.8467556238174438,
79
+ -1.4545854091644288,
80
+ -5.945669202804565,
81
+ 0.0,
82
+ 0.0
83
+ ],
84
+ "q99": [
85
+ 5.016749763488781,
86
+ 3.4728481292724593,
87
+ 4.225283479690551,
88
+ 1.7033938264846804,
89
+ 1.4612830877304077,
90
+ 2.8437052965164185,
91
+ 1.258314609527588,
92
+ 2.898959903717041,
93
+ 3.12267804145813,
94
+ 1.750970482826233,
95
+ 1.280245304107666,
96
+ 3.4143478631973267,
97
+ 1.0,
98
+ 1.0
99
+ ],
100
+ "mask": [
101
+ true,
102
+ true,
103
+ true,
104
+ true,
105
+ true,
106
+ true,
107
+ true,
108
+ true,
109
+ true,
110
+ true,
111
+ true,
112
+ true,
113
+ false,
114
+ false
115
+ ]
116
+ },
117
+ "state": {
118
+ "mean": [
119
+ -0.21762139897793528,
120
+ 1.0445352470874787,
121
+ 0.7618057584762571,
122
+ -0.33136719916015855,
123
+ 0.06322407866467984,
124
+ -0.06871131842024625,
125
+ 0.22887468233704572,
126
+ 1.1339007771015168,
127
+ 0.8465183085203172,
128
+ -0.37649038800038415,
129
+ -0.02524788704147795,
130
+ 0.03936799738556147,
131
+ 0.682512201219797,
132
+ 0.6585012382268904
133
+ ],
134
+ "std": [
135
+ 0.38712398853080604,
136
+ 0.9965709002640186,
137
+ 0.7823577599579604,
138
+ 0.6681911921924909,
139
+ 0.2584405378948888,
140
+ 0.6233249305188155,
141
+ 0.323771915217167,
142
+ 1.0139910538683092,
143
+ 0.8113518216713491,
144
+ 0.7220370403976613,
145
+ 0.2687367916036712,
146
+ 0.6730492302105592,
147
+ 0.4465031278188237,
148
+ 0.4541251057289932
149
+ ],
150
+ "max": [
151
+ 5.681515216827393,
152
+ 3.8880207538604736,
153
+ 4.500889301300049,
154
+ 1.789766788482666,
155
+ 1.5632697343826294,
156
+ 4.389739513397217,
157
+ 1.3892723321914673,
158
+ 3.242604970932007,
159
+ 3.6588551998138428,
160
+ 1.9530924558639526,
161
+ 1.397123098373413,
162
+ 3.503765106201172,
163
+ 1.0,
164
+ 1.0
165
+ ],
166
+ "min": [
167
+ -7.340834140777588,
168
+ -0.0003164021181873977,
169
+ -0.1190902441740036,
170
+ -1.9268131256103516,
171
+ -1.4216828346252441,
172
+ -6.232340335845947,
173
+ -6.316576957702637,
174
+ -0.5742834806442261,
175
+ -0.005311839282512665,
176
+ -1.9893786907196045,
177
+ -2.1285502910614014,
178
+ -6.269529342651367,
179
+ 0.0,
180
+ 0.0
181
+ ],
182
+ "q01": [
183
+ -7.334665780067444,
184
+ -5.257390398583084e-07,
185
+ -2.2967718905420043e-05,
186
+ -1.841589093208313,
187
+ -1.1798312604427337,
188
+ -5.543431510925292,
189
+ -5.912737417221069,
190
+ -0.36572347044944764,
191
+ -2.81171942333458e-05,
192
+ -1.8467556238174438,
193
+ -1.440324923992157,
194
+ -5.8623305034637445,
195
+ 0.0,
196
+ 0.0
197
+ ],
198
+ "q99": [
199
+ 4.902149534225477,
200
+ 3.4690011501312243,
201
+ 4.224453401565551,
202
+ 1.7033938264846804,
203
+ 1.4611416244506834,
204
+ 2.8405991554260255,
205
+ 1.258314609527588,
206
+ 2.898959903717041,
207
+ 3.12267804145813,
208
+ 1.7416918659210197,
209
+ 1.280245304107666,
210
+ 3.4138864517211913,
211
+ 1.0,
212
+ 1.0
213
+ ]
214
+ },
215
+ "num_transitions": 549787,
216
+ "num_trajectories": 2500
217
+ }
218
+ }
final_model/pytorch_model.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:80b11c6ab0b47f5a6cc417985b884f691711e7ee3a323bfb7925bd13ae1f5c78
3
+ size 9785123858
run_robocoin_finetune_robotwin_abs_random_action_frombalance.sh ADDED
@@ -0,0 +1,124 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ #!/bin/bash
2
+ #SBATCH --job-name=robotwin_qwra
3
+ #SBATCH --partition=vonneumann
4
+ #SBATCH --account=vonneumann1
5
+ #SBATCH --nodes=1
6
+ #SBATCH --gpus-per-node=8
7
+ #SBATCH --cpus-per-gpu=24
8
+ #SBATCH --ntasks-per-node=1
9
+ #SBATCH --output=logs/robotwin_qwra_%j.out
10
+ #SBATCH --error=logs/robotwin_qwra_%j.err
11
+
12
+ # ============================================================
13
+ # Robotwin abs finetune from RoboCOIN checkpoint
14
+ # Load only Qwen3-VL weights, keep action head randomly initialized.
15
+ # Submit: sbatch examples/Robocoin/train_files/run_robocoin_finetune_robotwin_abs_random_action_frombalance.sh
16
+ # ============================================================
17
+
18
+ set -eo pipefail
19
+
20
+ source /project/vonneumann1/sqyang/.bashrc
21
+ conda activate starVLA
22
+
23
+ export NCCL_SOCKET_IFNAME=bond0
24
+ export NCCL_IB_HCA=mlx5_2,mlx5_3
25
+ export NCCL_BLOCKING_WAIT=1
26
+ export NCCL_ASYNC_ERROR_HANDLING=1
27
+ export NCCL_TIMEOUT=3600
28
+
29
+ SCRIPT_REL_PATH=examples/Robocoin/train_files/run_robocoin_finetune_robotwin_abs_random_action_frombalance.sh
30
+ if [[ -n "${SLURM_SUBMIT_DIR:-}" && -d "${SLURM_SUBMIT_DIR}/starVLA" ]]; then
31
+ REPO_ROOT="${SLURM_SUBMIT_DIR}"
32
+ else
33
+ SCRIPT_DIR=$(cd -- "$(dirname -- "${BASH_SOURCE[0]}")" && pwd)
34
+ REPO_ROOT=$(cd -- "${SCRIPT_DIR}/../../.." && pwd)
35
+ fi
36
+
37
+ if [[ ! -d "${REPO_ROOT}/starVLA" ]]; then
38
+ echo "Resolved REPO_ROOT is invalid: ${REPO_ROOT}" >&2
39
+ exit 1
40
+ fi
41
+
42
+ SCRIPT_SOURCE="${REPO_ROOT}/${SCRIPT_REL_PATH}"
43
+ cd "${REPO_ROOT}"
44
+
45
+ export PYTHONPATH="${REPO_ROOT}:${PYTHONPATH:-}"
46
+
47
+ mkdir -p logs
48
+
49
+ MASTER_ADDR=$(scontrol show hostnames "$SLURM_JOB_NODELIST" | head -n 1)
50
+ MASTER_PORT=29500
51
+ export MASTER_ADDR MASTER_PORT
52
+
53
+ NNODES=${SLURM_NNODES:-1}
54
+ GPUS_PER_NODE=8
55
+ TOTAL_GPUS=$((NNODES * GPUS_PER_NODE))
56
+
57
+ echo "============================================"
58
+ echo "Job ID : $SLURM_JOB_ID"
59
+ echo "Nodes : $SLURM_NODELIST"
60
+ echo "NNODES : $NNODES"
61
+ echo "GPUS/NODE : $GPUS_PER_NODE"
62
+ echo "TOTAL GPUS : $TOTAL_GPUS"
63
+ echo "MASTER_ADDR : $MASTER_ADDR"
64
+ echo "MASTER_PORT : $MASTER_PORT"
65
+ echo "============================================"
66
+
67
+ Framework_name=QwenOFT
68
+ freeze_module_list=''
69
+ reload_modules='qwen_vl_interface'
70
+ base_vlm="${REPO_ROOT}/playground/Pretrained_models/Qwen3-VL-4B-Instruct"
71
+ config_yaml="${REPO_ROOT}/examples/Robotwin/train_files/starvla_cotrain_robotwin_abs_horizon32.yaml"
72
+ run_root_dir="${REPO_ROOT}/results/Checkpoints"
73
+ data_mix=robotwin_clean_32
74
+ data_root_dir="${REPO_ROOT}/playground/Datasets/RoboTwin-Clean"
75
+ lr_base=1e-05
76
+ lr_qwen=1e-05
77
+ lr_action=1e-04
78
+ pretrained_checkpoint="${REPO_ROOT}/results/Checkpoints/0328_robocoin_sq_all_qwen3OFT_freezeVisionLLMHalf_balanceDataset/checkpoints/steps_100000_pytorch_model.pt"
79
+ run_id=0328robotwin_clean_32_qwen3OFT_ft_abs_from_robocoin_1x100k_qwenonly_randomaction_horizon32_frombalance
80
+
81
+ output_dir=${run_root_dir}/${run_id}
82
+ mkdir -p "${output_dir}"
83
+ if [[ -f "${SCRIPT_SOURCE}" ]]; then
84
+ cp "${SCRIPT_SOURCE}" "${output_dir}/"
85
+ else
86
+ cp "$0" "${output_dir}/"
87
+ fi
88
+
89
+
90
+ echo "Pretrained checkpoint : ${pretrained_checkpoint}"
91
+ echo "Reload modules : ${reload_modules}"
92
+ echo "Freeze modules : ${freeze_module_list:-<none>}"
93
+ echo "Learning rates : base=${lr_base}, qwen=${lr_qwen}, action=${lr_action}"
94
+
95
+ srun --kill-on-bad-exit=1 bash -c '
96
+ accelerate launch \
97
+ --config_file '"${REPO_ROOT}"'/starVLA/config/deepseeds/deepspeed_zero2.yaml \
98
+ --main_process_ip '"$MASTER_ADDR"' \
99
+ --main_process_port '"$MASTER_PORT"' \
100
+ --machine_rank $SLURM_PROCID \
101
+ --num_machines '"$NNODES"' \
102
+ --num_processes '"$TOTAL_GPUS"' \
103
+ '"${REPO_ROOT}"'/starVLA/training/train_starvla.py \
104
+ --config_yaml '"$config_yaml"' \
105
+ --framework.name '"$Framework_name"' \
106
+ --framework.qwenvl.base_vlm '"$base_vlm"' \
107
+ --datasets.vla_data.per_device_batch_size 16 \
108
+ --datasets.vla_data.data_mix '"$data_mix"' \
109
+ --datasets.vla_data.data_root_dir '"$data_root_dir"' \
110
+ --trainer.freeze_modules '"$freeze_module_list"' \
111
+ --trainer.pretrained_checkpoint '"$pretrained_checkpoint"' \
112
+ --trainer.reload_modules '"$reload_modules"' \
113
+ --trainer.learning_rate.base '"$lr_base"' \
114
+ --trainer.learning_rate.qwen_vl_interface '"$lr_qwen"' \
115
+ --trainer.learning_rate.action_model '"$lr_action"' \
116
+ --trainer.max_train_steps 50000 \
117
+ --trainer.save_interval 10000 \
118
+ --trainer.logging_frequency 100 \
119
+ --trainer.eval_interval 1000 \
120
+ --run_root_dir '"$run_root_dir"' \
121
+ --run_id '"$run_id"' \
122
+ --wandb_project EM-LLaVA \
123
+ --wandb_entity yangsenqiao
124
+ '
summary.jsonl ADDED
@@ -0,0 +1,5 @@
 
 
 
 
 
 
1
+ {"steps": 10000}
2
+ {"steps": 20000}
3
+ {"steps": 30000}
4
+ {"steps": 40000}
5
+ {"steps": 50000}