Caesarrr commited on
Commit
523b5df
·
verified ·
1 Parent(s): c99cff1

Upload folder using huggingface_hub

Browse files
This view is limited to 50 files because it contains too many changes.   See raw diff
Files changed (50) hide show
  1. .gitattributes +2 -0
  2. flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt +3 -0
  3. flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/steps_4000_model.safetensors +3 -0
  4. flappy_fix_latency_2_200ep_7k2steps_stitch/config.full.yaml +249 -0
  5. flappy_fix_latency_2_200ep_7k2steps_stitch/config.yaml +102 -0
  6. flappy_fix_latency_2_200ep_7k2steps_stitch/dataset_statistics.json +127 -0
  7. flappy_fix_latency_2_200ep_7k2steps_stitch/dataset_statistics_eval.json +127 -0
  8. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1000.json +120 -0
  9. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1250.json +120 -0
  10. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1500.json +120 -0
  11. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1750.json +120 -0
  12. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2000.json +120 -0
  13. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2250.json +120 -0
  14. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_250.json +120 -0
  15. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2500.json +120 -0
  16. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2750.json +120 -0
  17. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3000.json +120 -0
  18. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3250.json +120 -0
  19. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3500.json +120 -0
  20. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3750.json +120 -0
  21. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_4000.json +120 -0
  22. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_500.json +120 -0
  23. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_750.json +120 -0
  24. flappy_fix_latency_2_200ep_7k2steps_stitch/eval/post_train/step_4000.json +240 -0
  25. flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/config.yaml +247 -0
  26. flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/hydra.yaml +368 -0
  27. flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/overrides.yaml +208 -0
  28. flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/train_starvla_hydra.log +0 -0
  29. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/_progress/rank_0.json +1 -0
  30. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/_progress/rank_1.json +1 -0
  31. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2/episode_metrics.jsonl +10 -0
  32. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/_progress/rank_0.json +1 -0
  33. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/_progress/rank_1.json +1 -0
  34. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2/episode_metrics.jsonl +10 -0
  35. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/_progress/rank_0.json +1 -0
  36. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/_progress/rank_1.json +1 -0
  37. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2/episode_metrics.jsonl +10 -0
  38. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/_progress/rank_0.json +1 -0
  39. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/_progress/rank_1.json +1 -0
  40. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2/episode_metrics.jsonl +10 -0
  41. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/_progress/rank_0.json +1 -0
  42. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/_progress/rank_1.json +1 -0
  43. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2/episode_metrics.jsonl +10 -0
  44. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/_progress/rank_0.json +1 -0
  45. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/_progress/rank_1.json +1 -0
  46. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2/episode_metrics.jsonl +10 -0
  47. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/_progress/rank_0.json +1 -0
  48. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/_progress/rank_1.json +1 -0
  49. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2/episode_metrics.jsonl +10 -0
  50. flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2500/_progress/rank_0.json +1 -0
.gitattributes CHANGED
@@ -36,3 +36,5 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
36
  flappy_fix_latency_2_200ep_7k2steps_kv_memory_flex/wandb/wandb/run-20260628_174516-d5o0ia06/run-d5o0ia06.wandb filter=lfs diff=lfs merge=lfs -text
37
  flappy_fix_latency_2_200ep_7k2steps_single_baseline/wandb/wandb/run-20260629_061046-mj819fop/run-mj819fop.wandb filter=lfs diff=lfs merge=lfs -text
38
  flappy_fix_latency_2_200ep_7k2steps_plain_multi/wandb/wandb/run-20260629_115519-lyl43qp2/run-lyl43qp2.wandb filter=lfs diff=lfs merge=lfs -text
 
 
 
36
  flappy_fix_latency_2_200ep_7k2steps_kv_memory_flex/wandb/wandb/run-20260628_174516-d5o0ia06/run-d5o0ia06.wandb filter=lfs diff=lfs merge=lfs -text
37
  flappy_fix_latency_2_200ep_7k2steps_single_baseline/wandb/wandb/run-20260629_061046-mj819fop/run-mj819fop.wandb filter=lfs diff=lfs merge=lfs -text
38
  flappy_fix_latency_2_200ep_7k2steps_plain_multi/wandb/wandb/run-20260629_115519-lyl43qp2/run-lyl43qp2.wandb filter=lfs diff=lfs merge=lfs -text
39
+ flappy_fix_latency_2_200ep_7k2steps_stitch/wandb/wandb/run-20260630_041200-hmyjkpa8/run-hmyjkpa8.wandb filter=lfs diff=lfs merge=lfs -text
40
+ flappy_fix_latency_2_200ep_7k2steps_stitch/wandb/wandb/run-20260630_041925-z7qwgx6l/run-z7qwgx6l.wandb filter=lfs diff=lfs merge=lfs -text
flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:371cb744227687bb99bcad7f9ff2250cf06da75631359ad3eba4c6bc52570607
3
+ size 9785060316
flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/steps_4000_model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d29f05e6565500aecc785f04b687b107f703021b59947f2d261d167fb932c3f5
3
+ size 9784896838
flappy_fix_latency_2_200ep_7k2steps_stitch/config.full.yaml ADDED
@@ -0,0 +1,249 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ framework:
2
+ name: QwenOFT
3
+ qwenvl:
4
+ base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
5
+ attn_implementation: flash_attention_2
6
+ flex_backend: triton
7
+ enable_gradient_checkpointing: true
8
+ action_model:
9
+ action_model_type: MLP
10
+ action_dim: 7
11
+ action_hidden_dim: 2560
12
+ future_action_window_size: 0
13
+ past_action_window_size: 0
14
+ loss_type: discrete_ce
15
+ state_dim: 7
16
+ action_horizon: 1
17
+ action_env_dim: 2
18
+ kv_memory:
19
+ enabled: false
20
+ window: 4
21
+ rollout_len: 8
22
+ packed_train: false
23
+ rebased_sink: true
24
+ datasets:
25
+ vla_data:
26
+ dataset_py: lerobot_datasets
27
+ include_state: true
28
+ data_root_dir: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
29
+ data_mix: flappy_train__bridge
30
+ eval_data_mix: flappy_train__bridge__val
31
+ custom_mixtures_path: null
32
+ action_type: discrete
33
+ sequential_step_sampling: false
34
+ eval_sequential_step_sampling: null
35
+ num_workers: 8
36
+ eval_num_workers: 8
37
+ prefetch_factor: 4
38
+ persistent_workers: true
39
+ pin_memory: true
40
+ shuffle: true
41
+ action_balance:
42
+ enabled: false
43
+ strategy: balanced_epoch
44
+ action_key: action_id
45
+ target_flap_fraction: 0.3
46
+ noop_id: 0
47
+ flap_id: 1
48
+ latency_curriculum:
49
+ enabled: false
50
+ strategy: exclusive
51
+ latencies: null
52
+ phase_steps: null
53
+ phase_distributions: null
54
+ new_latency_passes: 1.0
55
+ replay_passes: 0.25
56
+ target_total_passes: 2.0
57
+ final_equalization: true
58
+ step_budget_mode: auto
59
+ eval_at_phase_end: false
60
+ save_at_phase_end: false
61
+ computed_plan: null
62
+ per_device_batch_size: 32
63
+ load_all_data_for_training: true
64
+ num_obs_frames: 4
65
+ image_mode: stitch
66
+ prompt_mode: raw
67
+ stitch_grid:
68
+ - 2
69
+ - 2
70
+ obs_image_size: null
71
+ video_backend: torchvision_av
72
+ dataset:
73
+ source_hf: ''
74
+ config_name: null
75
+ source_subdir: null
76
+ converted_name: flappy_train
77
+ single_source_hf: ''
78
+ mixed_source_hf: ''
79
+ single_converted_name: flappy_train
80
+ mixed_converted_name: flappy_mixed_latency_train
81
+ single_latency_filter: null
82
+ mixed_latency_filter: null
83
+ force_download: false
84
+ setup_force: false
85
+ skip_verification: false
86
+ verify_rows: 200
87
+ max_episodes: null
88
+ episodes_per_latency: null
89
+ latency_filter: null
90
+ debug_subset:
91
+ enabled: false
92
+ max_episodes: 5
93
+ suffix: debug
94
+ base_model:
95
+ repo_id: Qwen/Qwen3-VL-4B-Instruct
96
+ initialization:
97
+ checkpoint_local_dir: playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
98
+ checkpoint_hf_repo_id: StarVLA/Qwen3VL-OFT-Bridge-RT-1
99
+ checkpoint_filename: checkpoints/steps_5000_pytorch_model.pt
100
+ trainer:
101
+ max_train_steps: 4000
102
+ num_warmup_steps: 100
103
+ save_interval: 500
104
+ eval_interval: 250
105
+ eval_num_batches: 50
106
+ per_latency_eval_num_batches: null
107
+ eval_action_classification: false
108
+ eval_action_classification_interval: null
109
+ cc_f1_tolerance: 1
110
+ learning_rate:
111
+ base: 2.0e-05
112
+ qwen_vl_interface: 1.0e-05
113
+ action_model: 0.0001
114
+ lr_scheduler_type: cosine_with_min_lr
115
+ scheduler_specific_kwargs:
116
+ min_lr: 1.0e-06
117
+ freeze_modules: ''
118
+ freeze_vit: false
119
+ freeze_tied_embedding: false
120
+ freeze_llm_layers: []
121
+ loss_scale:
122
+ vla: 1.0
123
+ vlm: 0.1
124
+ max_grad_norm: 1.0
125
+ weight_decay: 0.0
126
+ logging_frequency: 1
127
+ profile_timing:
128
+ enabled: false
129
+ log_interval: 10
130
+ gradient_clipping: 1.0
131
+ gradient_accumulation_steps: 2
132
+ distributed_backend: deepspeed
133
+ is_resume: false
134
+ pretrained_checkpoint: null
135
+ resume_step: 0
136
+ reload_modules: null
137
+ optimizer:
138
+ name: AdamW
139
+ betas:
140
+ - 0.9
141
+ - 0.95
142
+ eps: 1.0e-08
143
+ weight_decay: 1.0e-08
144
+ fused: true
145
+ save_format: pt
146
+ workspace_dir: WORKSPACE_DIR
147
+ run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
148
+ seed: 42
149
+ wandb_entity: saberrr-zju
150
+ wandb_project: starVLA_rl_games
151
+ auth:
152
+ env_file: null
153
+ hf_token_env: HF_TOKEN
154
+ wandb_api_key_env: WANDB_API_KEY
155
+ paths:
156
+ run_root_dir: results/Checkpoints
157
+ dataset_local_dir: data/flappy_fix_latency_2_200ep_7k2steps
158
+ dataset_cache_dir: null
159
+ base_model_dir: playground/Pretrained_models/Qwen3-VL-4B-Instruct
160
+ accelerate_config: starVLA/config/deepseeds/deepspeed_zero2.yaml
161
+ launch:
162
+ use_accelerate: true
163
+ gpus: null
164
+ num_processes: 1
165
+ dry_run: false
166
+ conda:
167
+ enabled: true
168
+ env_name: null
169
+ rl_games:
170
+ model_alias: openvla
171
+ env_eval:
172
+ image_size: 224
173
+ frameskip: 1
174
+ image_transform: raw_rgb
175
+ prompt_mode: raw
176
+ ghost_trail:
177
+ history_frames: 5
178
+ gamma: 1.3
179
+ min_alpha: 35
180
+ scroll_px_per_step: 4.0
181
+ ground_fraction: 0.22
182
+ seed: 42
183
+ fixed_episode_seeds: true
184
+ latency_seed_stride: 0
185
+ task_seed_stride: 0
186
+ task_description: ''
187
+ eval_parallel_envs: 5
188
+ enabled: true
189
+ eval_backend: latency_bench
190
+ distributed_mode: rank_sharded
191
+ vectorized:
192
+ enabled: false
193
+ batch_size: 1
194
+ latency:
195
+ prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
196
+ mode: single
197
+ values:
198
+ - 0
199
+ mid_train:
200
+ enabled: true
201
+ interval_steps: 250
202
+ latencies:
203
+ - 2
204
+ num_episodes: 20
205
+ max_steps_per_episode: 3600
206
+ post_train:
207
+ enabled: true
208
+ latencies:
209
+ - 2
210
+ num_episodes: 50
211
+ max_steps_per_episode: 3600
212
+ task: flappy
213
+ initialization_mode: bridge
214
+ action_carrier: bridge
215
+ model: openvla
216
+ env: flappy
217
+ init: bridge
218
+ bridge_base_model:
219
+ repo_id:
220
+ openvla: Qwen/Qwen3-VL-4B-Instruct
221
+ pi0: StarVLA/Qwen2.5-VL-3B-Instruct-Action
222
+ pi05: Qwen/Qwen3-VL-4B-Instruct
223
+ gr00t: Qwen/Qwen3-VL-4B-Instruct
224
+ local_dir:
225
+ openvla: playground/Pretrained_models/Qwen3-VL-4B-Instruct
226
+ pi0: playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
227
+ pi05: playground/Pretrained_models/Qwen3-VL-4B-Instruct
228
+ gr00t: playground/Pretrained_models/Qwen3-VL-4B-Instruct
229
+ mode: single
230
+ checkpoint:
231
+ load: none
232
+ hf_repo_id: null
233
+ save_best_model: false
234
+ save_final_model: true
235
+ save_pt_file: false
236
+ save_safetensors_file: true
237
+ local:
238
+ keep_last_n: 1
239
+ sync:
240
+ enabled: false
241
+ repo_id: null
242
+ keep_last_n: 0
243
+ sync_every_n_checkpoints: 1
244
+ resume_policy: local_latest
245
+ run_id: flappy_fix_latency_2_200ep_7k2steps_stitch
246
+ output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch
247
+ config_yaml: null
248
+ is_debug: false
249
+ version_id: '0.21'
flappy_fix_latency_2_200ep_7k2steps_stitch/config.yaml ADDED
@@ -0,0 +1,102 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ checkpoint:
2
+ local:
3
+ keep_last_n: 1
4
+ save_best_model: false
5
+ save_final_model: true
6
+ save_pt_file: false
7
+ save_safetensors_file: true
8
+ sync:
9
+ enabled: false
10
+ keep_last_n: 0
11
+ repo_id: null
12
+ datasets:
13
+ vla_data:
14
+ data_mix: flappy_train__bridge
15
+ dataset_py: lerobot_datasets
16
+ eval_data_mix: flappy_train__bridge__val
17
+ latency_curriculum:
18
+ enabled: false
19
+ obs_image_size: null
20
+ per_device_batch_size: 32
21
+ framework:
22
+ action_model:
23
+ action_dim: 7
24
+ action_env_dim: 2
25
+ action_hidden_dim: 2560
26
+ action_horizon: 1
27
+ action_model_type: MLP
28
+ loss_type: discrete_ce
29
+ kv_memory:
30
+ enabled: false
31
+ packed_train: false
32
+ rebased_sink: true
33
+ rollout_len: 8
34
+ window: 4
35
+ name: QwenOFT
36
+ qwenvl:
37
+ attn_implementation: flash_attention_2
38
+ base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
39
+ enable_gradient_checkpointing: true
40
+ output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch
41
+ rl_games:
42
+ env_eval:
43
+ distributed_mode: rank_sharded
44
+ enabled: true
45
+ eval_backend: latency_bench
46
+ eval_parallel_envs: 5
47
+ fixed_episode_seeds: true
48
+ image_size: 224
49
+ image_transform: raw_rgb
50
+ latency:
51
+ prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
52
+ mid_train:
53
+ enabled: true
54
+ interval_steps: 250
55
+ latencies:
56
+ - 2
57
+ max_steps_per_episode: 3600
58
+ num_episodes: 20
59
+ prompt_mode: raw
60
+ seed: 42
61
+ model_alias: openvla
62
+ task: flappy
63
+ run_id: flappy_fix_latency_2_200ep_7k2steps_stitch
64
+ run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
65
+ seed: 42
66
+ trainer:
67
+ distributed_backend: deepspeed
68
+ eval_action_classification: false
69
+ eval_action_classification_interval: null
70
+ eval_interval: 250
71
+ eval_num_batches: 50
72
+ freeze_llm_layers: []
73
+ freeze_modules: ''
74
+ freeze_tied_embedding: false
75
+ freeze_vit: false
76
+ gradient_accumulation_steps: 2
77
+ is_resume: false
78
+ learning_rate:
79
+ action_model: 0.0001
80
+ base: 2.0e-05
81
+ qwen_vl_interface: 1.0e-05
82
+ logging_frequency: 1
83
+ lr_scheduler_type: cosine_with_min_lr
84
+ max_train_steps: 4000
85
+ num_warmup_steps: 100
86
+ optimizer:
87
+ betas:
88
+ - 0.9
89
+ - 0.95
90
+ eps: 1.0e-08
91
+ fused: true
92
+ weight_decay: 1.0e-08
93
+ per_latency_eval_num_batches: null
94
+ pretrained_checkpoint: null
95
+ profile_timing:
96
+ enabled: false
97
+ reload_modules: null
98
+ save_interval: 500
99
+ scheduler_specific_kwargs:
100
+ min_lr: 1.0e-06
101
+ wandb_entity: saberrr-zju
102
+ wandb_project: starVLA_rl_games
flappy_fix_latency_2_200ep_7k2steps_stitch/dataset_statistics.json ADDED
@@ -0,0 +1,127 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "new_embodiment": {
3
+ "action": {
4
+ "mean": [
5
+ 0.8029062747955322,
6
+ 0.19709371030330658,
7
+ 0.0,
8
+ 0.0,
9
+ 0.0,
10
+ 0.0,
11
+ 0.0
12
+ ],
13
+ "std": [
14
+ 0.395094633102417,
15
+ 0.395094633102417,
16
+ 0.0,
17
+ 0.0,
18
+ 0.0,
19
+ 0.0,
20
+ 0.0
21
+ ],
22
+ "max": [
23
+ 1.0,
24
+ 1.0,
25
+ 0.0,
26
+ 0.0,
27
+ 0.0,
28
+ 0.0,
29
+ 0.0
30
+ ],
31
+ "min": [
32
+ 0.0,
33
+ 0.0,
34
+ 0.0,
35
+ 0.0,
36
+ 0.0,
37
+ 0.0,
38
+ 0.0
39
+ ],
40
+ "q01": [
41
+ 0.0,
42
+ 0.0,
43
+ 0.0,
44
+ 0.0,
45
+ 0.0,
46
+ 0.0,
47
+ 0.0
48
+ ],
49
+ "q99": [
50
+ 1.0,
51
+ 1.0,
52
+ 0.0,
53
+ 0.0,
54
+ 0.0,
55
+ 0.0,
56
+ 0.0
57
+ ],
58
+ "mask": [
59
+ true,
60
+ true,
61
+ true,
62
+ true,
63
+ true,
64
+ true,
65
+ true
66
+ ]
67
+ },
68
+ "state": {
69
+ "mean": [
70
+ 0.0,
71
+ 0.0,
72
+ 0.0,
73
+ 0.0,
74
+ 0.0,
75
+ 0.0,
76
+ 0.0
77
+ ],
78
+ "std": [
79
+ 0.0,
80
+ 0.0,
81
+ 0.0,
82
+ 0.0,
83
+ 0.0,
84
+ 0.0,
85
+ 0.0
86
+ ],
87
+ "max": [
88
+ 0.0,
89
+ 0.0,
90
+ 0.0,
91
+ 0.0,
92
+ 0.0,
93
+ 0.0,
94
+ 0.0
95
+ ],
96
+ "min": [
97
+ 0.0,
98
+ 0.0,
99
+ 0.0,
100
+ 0.0,
101
+ 0.0,
102
+ 0.0,
103
+ 0.0
104
+ ],
105
+ "q01": [
106
+ 0.0,
107
+ 0.0,
108
+ 0.0,
109
+ 0.0,
110
+ 0.0,
111
+ 0.0,
112
+ 0.0
113
+ ],
114
+ "q99": [
115
+ 0.0,
116
+ 0.0,
117
+ 0.0,
118
+ 0.0,
119
+ 0.0,
120
+ 0.0,
121
+ 0.0
122
+ ]
123
+ },
124
+ "num_transitions": 1291269,
125
+ "num_trajectories": 180
126
+ }
127
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/dataset_statistics_eval.json ADDED
@@ -0,0 +1,127 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "new_embodiment": {
3
+ "action": {
4
+ "mean": [
5
+ 0.8033548593521118,
6
+ 0.19664514064788818,
7
+ 0.0,
8
+ 0.0,
9
+ 0.0,
10
+ 0.0,
11
+ 0.0
12
+ ],
13
+ "std": [
14
+ 0.39764848351478577,
15
+ 0.39764848351478577,
16
+ 0.0,
17
+ 0.0,
18
+ 0.0,
19
+ 0.0,
20
+ 0.0
21
+ ],
22
+ "max": [
23
+ 1.0,
24
+ 1.0,
25
+ 0.0,
26
+ 0.0,
27
+ 0.0,
28
+ 0.0,
29
+ 0.0
30
+ ],
31
+ "min": [
32
+ 0.0,
33
+ 0.0,
34
+ 0.0,
35
+ 0.0,
36
+ 0.0,
37
+ 0.0,
38
+ 0.0
39
+ ],
40
+ "q01": [
41
+ 0.0,
42
+ 0.0,
43
+ 0.0,
44
+ 0.0,
45
+ 0.0,
46
+ 0.0,
47
+ 0.0
48
+ ],
49
+ "q99": [
50
+ 1.0,
51
+ 1.0,
52
+ 0.0,
53
+ 0.0,
54
+ 0.0,
55
+ 0.0,
56
+ 0.0
57
+ ],
58
+ "mask": [
59
+ true,
60
+ true,
61
+ true,
62
+ true,
63
+ true,
64
+ true,
65
+ true
66
+ ]
67
+ },
68
+ "state": {
69
+ "mean": [
70
+ 0.0,
71
+ 0.0,
72
+ 0.0,
73
+ 0.0,
74
+ 0.0,
75
+ 0.0,
76
+ 0.0
77
+ ],
78
+ "std": [
79
+ 0.0,
80
+ 0.0,
81
+ 0.0,
82
+ 0.0,
83
+ 0.0,
84
+ 0.0,
85
+ 0.0
86
+ ],
87
+ "max": [
88
+ 0.0,
89
+ 0.0,
90
+ 0.0,
91
+ 0.0,
92
+ 0.0,
93
+ 0.0,
94
+ 0.0
95
+ ],
96
+ "min": [
97
+ 0.0,
98
+ 0.0,
99
+ 0.0,
100
+ 0.0,
101
+ 0.0,
102
+ 0.0,
103
+ 0.0
104
+ ],
105
+ "q01": [
106
+ 0.0,
107
+ 0.0,
108
+ 0.0,
109
+ 0.0,
110
+ 0.0,
111
+ 0.0,
112
+ 0.0
113
+ ],
114
+ "q99": [
115
+ 0.0,
116
+ 0.0,
117
+ 0.0,
118
+ 0.0,
119
+ 0.0,
120
+ 0.0,
121
+ 0.0
122
+ ]
123
+ },
124
+ "num_transitions": 143553,
125
+ "num_trajectories": 20
126
+ }
127
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 146.23500173576176,
7
+ "mean_length": 1196.4,
8
+ "std_reward": 140.56170437747195,
9
+ "std_length": 1133.7973981271964,
10
+ "episode_rewards": [
11
+ 6.500000096857548,
12
+ 176.40000209212303,
13
+ 174.80000206828117,
14
+ 3.90000007301569,
15
+ 127.50000151246786,
16
+ 6.500000096857548,
17
+ 288.4000034034252,
18
+ 6.500000096857548,
19
+ 6.70000009983778,
20
+ 444.6000052243471,
21
+ 3.90000007301569,
22
+ 232.40000274777412,
23
+ 138.90000165253878,
24
+ 3.90000007301569,
25
+ 444.6000052243471,
26
+ 6.500000096857548,
27
+ 249.00000293552876,
28
+ 138.90000165253878,
29
+ 190.4000022560358,
30
+ 274.40000323951244
31
+ ],
32
+ "episode_lengths": [
33
+ 67,
34
+ 1442,
35
+ 1426,
36
+ 50,
37
+ 1043,
38
+ 67,
39
+ 2346,
40
+ 67,
41
+ 69,
42
+ 3600,
43
+ 50,
44
+ 1894,
45
+ 1139,
46
+ 50,
47
+ 3600,
48
+ 67,
49
+ 2024,
50
+ 1139,
51
+ 1555,
52
+ 2233
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 146.23500173576176,
112
+ "mean_length": 1196.4,
113
+ "std_reward": 140.56170437747195,
114
+ "std_length": 1133.7973981271964,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 146.23500173576176,
117
+ "macro_mean_length": 1196.4,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 280.7200033083558,
7
+ "mean_length": 2280.2,
8
+ "std_reward": 160.46691622314893,
9
+ "std_length": 1292.9992111366503,
10
+ "episode_rewards": [
11
+ 57.500000692903996,
12
+ 113.50000134855509,
13
+ 32.80000041425228,
14
+ 393.50000462681055,
15
+ 277.0000032633543,
16
+ 46.800000578165054,
17
+ 291.0000034272671,
18
+ 444.6000052243471,
19
+ 169.50000200420618,
20
+ 342.5000040307641,
21
+ 333.0000039190054,
22
+ 37.300000466406345,
23
+ 326.8000038564205,
24
+ 444.6000052243471,
25
+ 81.00000096857548,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 478,
34
+ 930,
35
+ 285,
36
+ 3190,
37
+ 2250,
38
+ 398,
39
+ 2363,
40
+ 3600,
41
+ 1382,
42
+ 2779,
43
+ 2702,
44
+ 321,
45
+ 2658,
46
+ 3600,
47
+ 668,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 280.7200033083558,
112
+ "mean_length": 2280.2,
113
+ "std_reward": 160.46691622314893,
114
+ "std_length": 1292.9992111366503,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 280.7200033083558,
117
+ "macro_mean_length": 2280.2,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 123.54500146694481,
7
+ "mean_length": 1011.45,
8
+ "std_reward": 120.46388593553634,
9
+ "std_length": 971.7632672106926,
10
+ "episode_rewards": [
11
+ 57.500000692903996,
12
+ 113.50000134855509,
13
+ 444.6000052243471,
14
+ 67.0000008046627,
15
+ 123.0000014603138,
16
+ 244.5000028833747,
17
+ 137.00000162422657,
18
+ 155.5000018402934,
19
+ 211.5000024959445,
20
+ 6.800000101327896,
21
+ 11.100000150501728,
22
+ 85.50000102072954,
23
+ 6.800000101327896,
24
+ 333.1000039204955,
25
+ 6.800000101327896,
26
+ 43.80000053346157,
27
+ 90.50000108033419,
28
+ 291.0000034272671,
29
+ 34.60000042617321,
30
+ 6.800000101327896
31
+ ],
32
+ "episode_lengths": [
33
+ 478,
34
+ 930,
35
+ 3600,
36
+ 555,
37
+ 1007,
38
+ 1988,
39
+ 1120,
40
+ 1269,
41
+ 1721,
42
+ 70,
43
+ 104,
44
+ 704,
45
+ 70,
46
+ 2703,
47
+ 70,
48
+ 368,
49
+ 745,
50
+ 2363,
51
+ 294,
52
+ 70
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 123.54500146694481,
112
+ "mean_length": 1011.45,
113
+ "std_reward": 120.46388593553634,
114
+ "std_length": 971.7632672106926,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 123.54500146694481,
117
+ "macro_mean_length": 1011.45,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 360.8600042447448,
7
+ "mean_length": 2925.3,
8
+ "std_reward": 138.3481761636961,
9
+ "std_length": 1115.07690766153,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 123.0000014603138,
14
+ 444.6000052243471,
15
+ 431.0000050663948,
16
+ 444.6000052243471,
17
+ 45.90000056475401,
18
+ 444.6000052243471,
19
+ 151.00000178813934,
20
+ 444.6000052243471,
21
+ 333.0000039190054,
22
+ 272.50000321120024,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 81.00000096857548,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 1007,
36
+ 3600,
37
+ 3493,
38
+ 3600,
39
+ 389,
40
+ 3600,
41
+ 1233,
42
+ 3600,
43
+ 2702,
44
+ 2214,
45
+ 3600,
46
+ 3600,
47
+ 668,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 360.8600042447448,
112
+ "mean_length": 2925.3,
113
+ "std_reward": 138.3481761636961,
114
+ "std_length": 1115.07690766153,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 360.8600042447448,
117
+ "macro_mean_length": 2925.3,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 360.0050042357296,
7
+ "mean_length": 2918.9,
8
+ "std_reward": 151.56523681917494,
9
+ "std_length": 1220.8479389342476,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 176.40000209212303,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 440.80000518262386,
16
+ 8.400000125169754,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 180.9000021442771,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 8.400000125169754,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 160.8000019043684,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 1442,
35
+ 3600,
36
+ 3600,
37
+ 3573,
38
+ 86,
39
+ 3600,
40
+ 3600,
41
+ 1478,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 86,
49
+ 3600,
50
+ 3600,
51
+ 1313,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 360.0050042357296,
112
+ "mean_length": 2918.9,
113
+ "std_reward": 151.56523681917494,
114
+ "std_length": 1220.8479389342476,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 360.0050042357296,
117
+ "macro_mean_length": 2918.9,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 444.6000052243471,
7
+ "mean_length": 3600.0,
8
+ "std_reward": 0.0,
9
+ "std_length": 0.0,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 444.6000052243471,
112
+ "mean_length": 3600.0,
113
+ "std_reward": 0.0,
114
+ "std_length": 0.0,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 444.6000052243471,
117
+ "macro_mean_length": 3600.0,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 4.260000076889992,
7
+ "mean_length": 52.7,
8
+ "std_reward": 0.6703730361608478,
9
+ "std_length": 4.160528812542944,
10
+ "episode_rewards": [
11
+ 3.90000007301569,
12
+ 3.90000007301569,
13
+ 4.4000000804662704,
14
+ 4.300000078976154,
15
+ 3.90000007301569,
16
+ 3.90000007301569,
17
+ 3.90000007301569,
18
+ 3.90000007301569,
19
+ 4.200000077486038,
20
+ 3.90000007301569,
21
+ 4.300000078976154,
22
+ 4.200000077486038,
23
+ 6.200000092387199,
24
+ 4.300000078976154,
25
+ 6.200000092387199,
26
+ 3.90000007301569,
27
+ 3.90000007301569,
28
+ 4.200000077486038,
29
+ 3.90000007301569,
30
+ 3.90000007301569
31
+ ],
32
+ "episode_lengths": [
33
+ 50,
34
+ 50,
35
+ 55,
36
+ 54,
37
+ 50,
38
+ 50,
39
+ 50,
40
+ 50,
41
+ 53,
42
+ 50,
43
+ 54,
44
+ 53,
45
+ 64,
46
+ 54,
47
+ 64,
48
+ 50,
49
+ 50,
50
+ 53,
51
+ 50,
52
+ 50
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 4.260000076889992,
112
+ "mean_length": 52.7,
113
+ "std_reward": 0.6703730361608478,
114
+ "std_length": 4.160528812542944,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 4.260000076889992,
117
+ "macro_mean_length": 52.7,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 374.0650043990463,
7
+ "mean_length": 3031.5,
8
+ "std_reward": 132.23581089941655,
9
+ "std_length": 1065.9950046787274,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 25.300000317394733,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 109.30000130087137,
16
+ 183.8000021725893,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 160.8000019043684,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 333.1000039204955,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 219,
35
+ 3600,
36
+ 3600,
37
+ 897,
38
+ 1498,
39
+ 3600,
40
+ 3600,
41
+ 1313,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 2703,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 374.0650043990463,
112
+ "mean_length": 3031.5,
113
+ "std_reward": 132.23581089941655,
114
+ "std_length": 1065.9950046787274,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 374.0650043990463,
117
+ "macro_mean_length": 3031.5,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 406.0250047739595,
7
+ "mean_length": 3289.7,
8
+ "std_reward": 116.08755398484,
9
+ "std_length": 935.4420398934399,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 117.00000140070915,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 438.8000051677227,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 6.500000096857548,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 965,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3562,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 67,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 406.0250047739595,
112
+ "mean_length": 3289.7,
113
+ "std_reward": 116.08755398484,
114
+ "std_length": 935.4420398934399,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 406.0250047739595,
117
+ "macro_mean_length": 3289.7,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 364.3000042848289,
7
+ "mean_length": 2952.95,
8
+ "std_reward": 144.07553743043889,
9
+ "std_length": 1161.7599784378872,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 11.100000150501728,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 431.1000050678849,
21
+ 444.6000052243471,
22
+ 34.60000042617321,
23
+ 258.6000030487776,
24
+ 244.6000028848648,
25
+ 444.6000052243471,
26
+ 417.10000490397215,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 109.10000129789114
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 104,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3494,
43
+ 3600,
44
+ 294,
45
+ 2102,
46
+ 1989,
47
+ 3600,
48
+ 3381,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 895
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 364.3000042848289,
112
+ "mean_length": 2952.95,
113
+ "std_reward": 144.07553743043889,
114
+ "std_length": 1161.7599784378872,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 364.3000042848289,
117
+ "macro_mean_length": 2952.95,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 339.66000399664046,
7
+ "mean_length": 2754.15,
8
+ "std_reward": 174.21704311057604,
9
+ "std_length": 1404.42996532401,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 43.80000053346157,
14
+ 11.100000150501728,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 29.800000369548798,
20
+ 18.50000024586916,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 99.80000118911266,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 365.80000430345535
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 368,
36
+ 104,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 255,
42
+ 169,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 820,
50
+ 3600,
51
+ 3600,
52
+ 2967
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 339.66000399664046,
112
+ "mean_length": 2754.15,
113
+ "std_reward": 174.21704311057604,
114
+ "std_length": 1404.42996532401,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 339.66000399664046,
117
+ "macro_mean_length": 2754.15,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 405.8750047717243,
7
+ "mean_length": 3288.3,
8
+ "std_reward": 106.27140320430965,
9
+ "std_length": 855.9304936734057,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 183.8000021725893,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 18.50000024586916,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 435.8000051230192,
30
+ 365.80000430345535
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 1498,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 169,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3532,
52
+ 2967
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 405.8750047717243,
112
+ "mean_length": 3288.3,
113
+ "std_reward": 106.27140320430965,
114
+ "std_length": 855.9304936734057,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 405.8750047717243,
117
+ "macro_mean_length": 3288.3,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 437.42000514045355,
7
+ "mean_length": 3542.35,
8
+ "std_reward": 21.653443397232223,
9
+ "std_length": 173.87043308164849,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 379.8000044673681,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 365.80000430345535
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3080,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 2967
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 437.42000514045355,
112
+ "mean_length": 3542.35,
113
+ "std_reward": 21.653443397232223,
114
+ "std_length": 173.87043308164849,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 437.42000514045355,
117
+ "macro_mean_length": 3542.35,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_4000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 411.3150048356503,
7
+ "mean_length": 3332.25,
8
+ "std_reward": 98.88728180982324,
9
+ "std_length": 796.8478446353482,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 118.50000140815973,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 110.90000132471323,
19
+ 438.7000051662326,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 971,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 913,
41
+ 3561,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 4000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 411.3150048356503,
112
+ "mean_length": 3332.25,
113
+ "std_reward": 98.88728180982324,
114
+ "std_length": 796.8478446353482,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 411.3150048356503,
117
+ "macro_mean_length": 3332.25,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 18.025000237300993,
7
+ "mean_length": 163.35,
8
+ "std_reward": 46.5835692673937,
9
+ "std_length": 375.20144922428005,
10
+ "episode_rewards": [
11
+ 4.900000087916851,
12
+ 6.800000101327896,
13
+ 4.500000081956387,
14
+ 3.90000007301569,
15
+ 6.800000101327896,
16
+ 4.900000087916851,
17
+ 4.800000086426735,
18
+ 4.900000087916851,
19
+ 6.800000101327896,
20
+ 48.7000005915761,
21
+ 3.90000007301569,
22
+ 6.800000101327896,
23
+ 4.900000087916851,
24
+ 3.90000007301569,
25
+ 216.8000025600195,
26
+ 4.900000087916851,
27
+ 6.800000101327896,
28
+ 6.800000101327896,
29
+ 4.800000086426735,
30
+ 3.90000007301569
31
+ ],
32
+ "episode_lengths": [
33
+ 60,
34
+ 70,
35
+ 56,
36
+ 50,
37
+ 70,
38
+ 60,
39
+ 59,
40
+ 60,
41
+ 70,
42
+ 408,
43
+ 50,
44
+ 70,
45
+ 60,
46
+ 50,
47
+ 1765,
48
+ 60,
49
+ 70,
50
+ 70,
51
+ 59,
52
+ 50
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 18.025000237300993,
112
+ "mean_length": 163.35,
113
+ "std_reward": 46.5835692673937,
114
+ "std_length": 375.20144922428005,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 18.025000237300993,
117
+ "macro_mean_length": 163.35,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 11.12500015757978,
7
+ "mean_length": 108.3,
8
+ "std_reward": 17.37244605595043,
9
+ "std_length": 138.48360913841032,
10
+ "episode_rewards": [
11
+ 4.600000083446503,
12
+ 4.900000087916851,
13
+ 3.90000007301569,
14
+ 3.90000007301569,
15
+ 4.900000087916851,
16
+ 4.600000083446503,
17
+ 3.90000007301569,
18
+ 4.600000083446503,
19
+ 71.50000085681677,
20
+ 43.50000052899122,
21
+ 3.90000007301569,
22
+ 3.90000007301569,
23
+ 3.90000007301569,
24
+ 3.90000007301569,
25
+ 3.90000007301569,
26
+ 4.600000083446503,
27
+ 4.900000087916851,
28
+ 3.90000007301569,
29
+ 4.800000086426735,
30
+ 34.500000424683094
31
+ ],
32
+ "episode_lengths": [
33
+ 57,
34
+ 60,
35
+ 50,
36
+ 50,
37
+ 60,
38
+ 57,
39
+ 50,
40
+ 57,
41
+ 591,
42
+ 365,
43
+ 50,
44
+ 50,
45
+ 50,
46
+ 50,
47
+ 50,
48
+ 57,
49
+ 60,
50
+ 50,
51
+ 59,
52
+ 293
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 11.12500015757978,
112
+ "mean_length": 108.3,
113
+ "std_reward": 17.37244605595043,
114
+ "std_length": 138.48360913841032,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 11.12500015757978,
117
+ "macro_mean_length": 108.3,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/post_train/step_4000.json ADDED
@@ -0,0 +1,240 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 50,
6
+ "mean_reward": 414.16800486892464,
7
+ "mean_length": 3355.18,
8
+ "std_reward": 87.76956622971467,
9
+ "std_length": 707.0275154475956,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 118.50000140815973,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 110.90000132471323,
19
+ 438.7000051662326,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471,
31
+ 444.6000052243471,
32
+ 444.6000052243471,
33
+ 444.6000052243471,
34
+ 444.6000052243471,
35
+ 444.6000052243471,
36
+ 444.6000052243471,
37
+ 444.6000052243471,
38
+ 444.6000052243471,
39
+ 214.6000025421381,
40
+ 444.6000052243471,
41
+ 444.6000052243471,
42
+ 444.6000052243471,
43
+ 444.6000052243471,
44
+ 444.6000052243471,
45
+ 155.80000184476376,
46
+ 444.6000052243471,
47
+ 444.6000052243471,
48
+ 444.6000052243471,
49
+ 444.6000052243471,
50
+ 444.6000052243471,
51
+ 444.6000052243471,
52
+ 174.50000206381083,
53
+ 377.60000444948673,
54
+ 444.6000052243471,
55
+ 444.6000052243471,
56
+ 444.6000052243471,
57
+ 444.6000052243471,
58
+ 444.6000052243471,
59
+ 444.6000052243471,
60
+ 444.6000052243471
61
+ ],
62
+ "episode_lengths": [
63
+ 3600,
64
+ 971,
65
+ 3600,
66
+ 3600,
67
+ 3600,
68
+ 3600,
69
+ 3600,
70
+ 913,
71
+ 3561,
72
+ 3600,
73
+ 3600,
74
+ 3600,
75
+ 3600,
76
+ 3600,
77
+ 3600,
78
+ 3600,
79
+ 3600,
80
+ 3600,
81
+ 3600,
82
+ 3600,
83
+ 3600,
84
+ 3600,
85
+ 3600,
86
+ 3600,
87
+ 3600,
88
+ 3600,
89
+ 3600,
90
+ 3600,
91
+ 1752,
92
+ 3600,
93
+ 3600,
94
+ 3600,
95
+ 3600,
96
+ 3600,
97
+ 1272,
98
+ 3600,
99
+ 3600,
100
+ 3600,
101
+ 3600,
102
+ 3600,
103
+ 3600,
104
+ 1423,
105
+ 3067,
106
+ 3600,
107
+ 3600,
108
+ 3600,
109
+ 3600,
110
+ 3600,
111
+ 3600,
112
+ 3600
113
+ ],
114
+ "decoded_action_hist": {},
115
+ "fixed_episode_seeds": true,
116
+ "eval_seed": 42,
117
+ "episode_seeds": [
118
+ null,
119
+ null,
120
+ null,
121
+ null,
122
+ null,
123
+ null,
124
+ null,
125
+ null,
126
+ null,
127
+ null,
128
+ null,
129
+ null,
130
+ null,
131
+ null,
132
+ null,
133
+ null,
134
+ null,
135
+ null,
136
+ null,
137
+ null,
138
+ null,
139
+ null,
140
+ null,
141
+ null,
142
+ null,
143
+ null,
144
+ null,
145
+ null,
146
+ null,
147
+ null,
148
+ null,
149
+ null,
150
+ null,
151
+ null,
152
+ null,
153
+ null,
154
+ null,
155
+ null,
156
+ null,
157
+ null,
158
+ null,
159
+ null,
160
+ null,
161
+ null,
162
+ null,
163
+ null,
164
+ null,
165
+ null,
166
+ null,
167
+ null
168
+ ],
169
+ "episode_indices": [
170
+ 0,
171
+ 1,
172
+ 2,
173
+ 3,
174
+ 4,
175
+ 5,
176
+ 6,
177
+ 7,
178
+ 8,
179
+ 9,
180
+ 10,
181
+ 11,
182
+ 12,
183
+ 13,
184
+ 14,
185
+ 15,
186
+ 16,
187
+ 17,
188
+ 18,
189
+ 19,
190
+ 20,
191
+ 21,
192
+ 22,
193
+ 23,
194
+ 24,
195
+ 25,
196
+ 26,
197
+ 27,
198
+ 28,
199
+ 29,
200
+ 30,
201
+ 31,
202
+ 32,
203
+ 33,
204
+ 34,
205
+ 35,
206
+ 36,
207
+ 37,
208
+ 38,
209
+ 39,
210
+ 40,
211
+ 41,
212
+ 42,
213
+ 43,
214
+ 44,
215
+ 45,
216
+ 46,
217
+ 47,
218
+ 48,
219
+ 49
220
+ ]
221
+ }
222
+ },
223
+ "aggregate": {
224
+ "stage": "post_train",
225
+ "step": 4000,
226
+ "task": "flappy",
227
+ "model_alias": "openvla",
228
+ "fixed_episode_seeds": true,
229
+ "eval_seed": 42,
230
+ "total_episodes": 50,
231
+ "mean_reward": 414.16800486892464,
232
+ "mean_length": 3355.18,
233
+ "std_reward": 87.76956622971467,
234
+ "std_length": 707.0275154475956,
235
+ "task_count": 1,
236
+ "macro_mean_reward": 414.16800486892464,
237
+ "macro_mean_length": 3355.18,
238
+ "distributed_eval": true
239
+ }
240
+ }
flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/config.yaml ADDED
@@ -0,0 +1,247 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ framework:
2
+ qwenvl:
3
+ base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
4
+ attn_implementation: flash_attention_2
5
+ flex_backend: triton
6
+ enable_gradient_checkpointing: true
7
+ action_model:
8
+ state_dim: 7
9
+ loss_type: discrete_ce
10
+ action_horizon: 1
11
+ future_action_window_size: 0
12
+ past_action_window_size: 0
13
+ action_dim: 7
14
+ action_env_dim: 2
15
+ kv_memory:
16
+ enabled: false
17
+ window: 4
18
+ rollout_len: 8
19
+ packed_train: false
20
+ rebased_sink: true
21
+ name: QwenOFT
22
+ datasets:
23
+ vla_data:
24
+ dataset_py: lerobot_datasets
25
+ include_state: true
26
+ data_root_dir: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
27
+ data_mix: flappy_train__bridge
28
+ eval_data_mix: flappy_train__bridge__val
29
+ custom_mixtures_path: null
30
+ action_type: discrete
31
+ sequential_step_sampling: false
32
+ eval_sequential_step_sampling: null
33
+ num_workers: 8
34
+ eval_num_workers: 8
35
+ prefetch_factor: 4
36
+ persistent_workers: true
37
+ pin_memory: true
38
+ shuffle: true
39
+ action_balance:
40
+ enabled: false
41
+ strategy: balanced_epoch
42
+ action_key: action_id
43
+ target_flap_fraction: 0.3
44
+ noop_id: 0
45
+ flap_id: 1
46
+ latency_curriculum:
47
+ enabled: false
48
+ strategy: exclusive
49
+ latencies: null
50
+ phase_steps: null
51
+ phase_distributions: null
52
+ new_latency_passes: 1.0
53
+ replay_passes: 0.25
54
+ target_total_passes: 2.0
55
+ final_equalization: true
56
+ step_budget_mode: auto
57
+ eval_at_phase_end: false
58
+ save_at_phase_end: false
59
+ computed_plan: null
60
+ per_device_batch_size: 32
61
+ load_all_data_for_training: true
62
+ num_obs_frames: 4
63
+ image_mode: stitch
64
+ prompt_mode: raw
65
+ stitch_grid:
66
+ - 2
67
+ - 2
68
+ obs_image_size: null
69
+ video_backend: torchvision_av
70
+ dataset:
71
+ source_hf: ''
72
+ config_name: null
73
+ source_subdir: null
74
+ converted_name: flappy_train
75
+ single_source_hf: ''
76
+ mixed_source_hf: ''
77
+ single_converted_name: flappy_train
78
+ mixed_converted_name: flappy_mixed_latency_train
79
+ single_latency_filter: null
80
+ mixed_latency_filter: null
81
+ force_download: false
82
+ setup_force: false
83
+ skip_verification: false
84
+ verify_rows: 200
85
+ max_episodes: null
86
+ episodes_per_latency: null
87
+ latency_filter: null
88
+ debug_subset:
89
+ enabled: false
90
+ max_episodes: 5
91
+ suffix: debug
92
+ base_model:
93
+ repo_id: Qwen/Qwen3-VL-4B-Instruct
94
+ initialization:
95
+ checkpoint_local_dir: playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
96
+ checkpoint_hf_repo_id: StarVLA/Qwen3VL-OFT-Bridge-RT-1
97
+ checkpoint_filename: checkpoints/steps_5000_pytorch_model.pt
98
+ trainer:
99
+ max_train_steps: 4000
100
+ num_warmup_steps: 100
101
+ save_interval: 500
102
+ eval_interval: 250
103
+ eval_num_batches: 50
104
+ per_latency_eval_num_batches: null
105
+ eval_action_classification: false
106
+ eval_action_classification_interval: null
107
+ cc_f1_tolerance: 1
108
+ learning_rate:
109
+ base: 2.0e-05
110
+ qwen_vl_interface: 1.0e-05
111
+ action_model: 0.0001
112
+ lr_scheduler_type: cosine_with_min_lr
113
+ scheduler_specific_kwargs:
114
+ min_lr: 1.0e-06
115
+ freeze_modules: ''
116
+ freeze_vit: false
117
+ freeze_tied_embedding: false
118
+ freeze_llm_layers: []
119
+ loss_scale:
120
+ vla: 1.0
121
+ vlm: 0.1
122
+ max_grad_norm: 1.0
123
+ weight_decay: 0.0
124
+ logging_frequency: 1
125
+ profile_timing:
126
+ enabled: false
127
+ log_interval: 10
128
+ gradient_clipping: 1.0
129
+ gradient_accumulation_steps: 2
130
+ distributed_backend: deepspeed
131
+ is_resume: false
132
+ pretrained_checkpoint: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
133
+ resume_step: 0
134
+ reload_modules: null
135
+ optimizer:
136
+ name: AdamW
137
+ betas:
138
+ - 0.9
139
+ - 0.95
140
+ eps: 1.0e-08
141
+ weight_decay: 1.0e-08
142
+ fused: true
143
+ save_format: pt
144
+ workspace_dir: WORKSPACE_DIR
145
+ run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
146
+ seed: 42
147
+ wandb_entity: saberrr-zju
148
+ wandb_project: starVLA_rl_games
149
+ auth:
150
+ env_file: null
151
+ hf_token_env: HF_TOKEN
152
+ wandb_api_key_env: WANDB_API_KEY
153
+ paths:
154
+ run_root_dir: results/Checkpoints
155
+ dataset_local_dir: data/flappy_fix_latency_2_200ep_7k2steps
156
+ dataset_cache_dir: null
157
+ base_model_dir: playground/Pretrained_models/Qwen3-VL-4B-Instruct
158
+ accelerate_config: starVLA/config/deepseeds/deepspeed_zero2.yaml
159
+ launch:
160
+ use_accelerate: true
161
+ gpus: null
162
+ num_processes: 1
163
+ dry_run: false
164
+ conda:
165
+ enabled: true
166
+ env_name: null
167
+ rl_games:
168
+ model_alias: openvla
169
+ env_eval:
170
+ image_size: 224
171
+ frameskip: 1
172
+ image_transform: raw_rgb
173
+ prompt_mode: raw
174
+ ghost_trail:
175
+ history_frames: 5
176
+ gamma: 1.3
177
+ min_alpha: 35
178
+ scroll_px_per_step: 4.0
179
+ ground_fraction: 0.22
180
+ seed: 42
181
+ fixed_episode_seeds: true
182
+ latency_seed_stride: 0
183
+ task_seed_stride: 0
184
+ task_description: ''
185
+ eval_parallel_envs: 5
186
+ enabled: true
187
+ eval_backend: latency_bench
188
+ distributed_mode: rank_sharded
189
+ vectorized:
190
+ enabled: false
191
+ batch_size: 1
192
+ latency:
193
+ prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
194
+ mode: single
195
+ values:
196
+ - 0
197
+ mid_train:
198
+ enabled: true
199
+ interval_steps: 250
200
+ latencies:
201
+ - 2
202
+ num_episodes: 20
203
+ max_steps_per_episode: 3600
204
+ post_train:
205
+ enabled: true
206
+ latencies:
207
+ - 2
208
+ num_episodes: 50
209
+ max_steps_per_episode: 3600
210
+ task: flappy
211
+ initialization_mode: bridge
212
+ action_carrier: bridge
213
+ model: openvla
214
+ env: flappy
215
+ init: bridge
216
+ bridge_base_model:
217
+ repo_id:
218
+ openvla: Qwen/Qwen3-VL-4B-Instruct
219
+ pi0: StarVLA/Qwen2.5-VL-3B-Instruct-Action
220
+ pi05: Qwen/Qwen3-VL-4B-Instruct
221
+ gr00t: Qwen/Qwen3-VL-4B-Instruct
222
+ local_dir:
223
+ openvla: playground/Pretrained_models/Qwen3-VL-4B-Instruct
224
+ pi0: playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
225
+ pi05: playground/Pretrained_models/Qwen3-VL-4B-Instruct
226
+ gr00t: playground/Pretrained_models/Qwen3-VL-4B-Instruct
227
+ mode: single
228
+ checkpoint:
229
+ load: none
230
+ hf_repo_id: null
231
+ save_best_model: false
232
+ save_final_model: true
233
+ save_pt_file: false
234
+ save_safetensors_file: true
235
+ local:
236
+ keep_last_n: 1
237
+ sync:
238
+ enabled: false
239
+ repo_id: null
240
+ keep_last_n: 0
241
+ sync_every_n_checkpoints: 1
242
+ resume_policy: local_latest
243
+ run_id: flappy_fix_latency_2_200ep_7k2steps_stitch
244
+ output_dir: null
245
+ config_yaml: null
246
+ is_debug: false
247
+ version_id: 0.21
flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/hydra.yaml ADDED
@@ -0,0 +1,368 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ hydra:
2
+ run:
3
+ dir: ${run_root_dir}/${run_id}/hydra
4
+ sweep:
5
+ dir: multirun/${now:%Y-%m-%d}/${now:%H-%M-%S}
6
+ subdir: ${hydra.job.num}
7
+ launcher:
8
+ _target_: hydra._internal.core_plugins.basic_launcher.BasicLauncher
9
+ sweeper:
10
+ _target_: hydra._internal.core_plugins.basic_sweeper.BasicSweeper
11
+ max_batch_size: null
12
+ params: null
13
+ help:
14
+ app_name: ${hydra.job.name}
15
+ header: '${hydra.help.app_name} is powered by Hydra.
16
+
17
+ '
18
+ footer: 'Powered by Hydra (https://hydra.cc)
19
+
20
+ Use --hydra-help to view Hydra specific help
21
+
22
+ '
23
+ template: '${hydra.help.header}
24
+
25
+ == Configuration groups ==
26
+
27
+ Compose your configuration from those groups (group=option)
28
+
29
+
30
+ $APP_CONFIG_GROUPS
31
+
32
+
33
+ == Config ==
34
+
35
+ Override anything in the config (foo.bar=value)
36
+
37
+
38
+ $CONFIG
39
+
40
+
41
+ ${hydra.help.footer}
42
+
43
+ '
44
+ hydra_help:
45
+ template: 'Hydra (${hydra.runtime.version})
46
+
47
+ See https://hydra.cc for more info.
48
+
49
+
50
+ == Flags ==
51
+
52
+ $FLAGS_HELP
53
+
54
+
55
+ == Configuration groups ==
56
+
57
+ Compose your configuration from those groups (For example, append hydra/job_logging=disabled
58
+ to command line)
59
+
60
+
61
+ $HYDRA_CONFIG_GROUPS
62
+
63
+
64
+ Use ''--cfg hydra'' to Show the Hydra config.
65
+
66
+ '
67
+ hydra_help: ???
68
+ hydra_logging:
69
+ version: 1
70
+ formatters:
71
+ simple:
72
+ format: '[%(asctime)s][HYDRA] %(message)s'
73
+ handlers:
74
+ console:
75
+ class: logging.StreamHandler
76
+ formatter: simple
77
+ stream: ext://sys.stdout
78
+ root:
79
+ level: INFO
80
+ handlers:
81
+ - console
82
+ loggers:
83
+ logging_example:
84
+ level: DEBUG
85
+ disable_existing_loggers: false
86
+ job_logging:
87
+ version: 1
88
+ formatters:
89
+ simple:
90
+ format: '[%(asctime)s][%(name)s][%(levelname)s] - %(message)s'
91
+ handlers:
92
+ console:
93
+ class: logging.StreamHandler
94
+ formatter: simple
95
+ stream: ext://sys.stdout
96
+ file:
97
+ class: logging.FileHandler
98
+ formatter: simple
99
+ filename: ${hydra.runtime.output_dir}/${hydra.job.name}.log
100
+ root:
101
+ level: INFO
102
+ handlers:
103
+ - console
104
+ - file
105
+ disable_existing_loggers: false
106
+ env: {}
107
+ mode: RUN
108
+ searchpath: []
109
+ callbacks: {}
110
+ output_subdir: .hydra
111
+ overrides:
112
+ hydra:
113
+ - hydra.mode=RUN
114
+ task:
115
+ - model=openvla
116
+ - env=flappy
117
+ - init=bridge
118
+ - mode=single
119
+ - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
120
+ - ++framework.qwenvl.attn_implementation=flash_attention_2
121
+ - ++framework.qwenvl.flex_backend=triton
122
+ - ++framework.qwenvl.enable_gradient_checkpointing=true
123
+ - ++framework.action_model.state_dim=7
124
+ - ++framework.action_model.loss_type=discrete_ce
125
+ - ++framework.action_model.action_horizon=1
126
+ - ++framework.action_model.future_action_window_size=0
127
+ - ++framework.action_model.past_action_window_size=0
128
+ - ++framework.action_model.action_dim=7
129
+ - ++framework.action_model.action_env_dim=2
130
+ - ++framework.kv_memory.enabled=false
131
+ - ++framework.kv_memory.window=4
132
+ - ++framework.kv_memory.rollout_len=8
133
+ - ++framework.kv_memory.packed_train=false
134
+ - ++framework.kv_memory.rebased_sink=true
135
+ - ++framework.name=QwenOFT
136
+ - ++datasets.vla_data.dataset_py=lerobot_datasets
137
+ - ++datasets.vla_data.include_state=true
138
+ - ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
139
+ - ++datasets.vla_data.data_mix=flappy_train
140
+ - ++datasets.vla_data.eval_data_mix=null
141
+ - ++datasets.vla_data.custom_mixtures_path=null
142
+ - ++datasets.vla_data.action_type=discrete
143
+ - ++datasets.vla_data.sequential_step_sampling=false
144
+ - ++datasets.vla_data.eval_sequential_step_sampling=null
145
+ - ++datasets.vla_data.num_workers=8
146
+ - ++datasets.vla_data.eval_num_workers=8
147
+ - ++datasets.vla_data.prefetch_factor=4
148
+ - ++datasets.vla_data.persistent_workers=true
149
+ - ++datasets.vla_data.pin_memory=true
150
+ - ++datasets.vla_data.shuffle=true
151
+ - ++datasets.vla_data.action_balance.enabled=false
152
+ - ++datasets.vla_data.action_balance.strategy=balanced_epoch
153
+ - ++datasets.vla_data.action_balance.action_key=action_id
154
+ - ++datasets.vla_data.action_balance.target_flap_fraction=0.3
155
+ - ++datasets.vla_data.action_balance.noop_id=0
156
+ - ++datasets.vla_data.action_balance.flap_id=1
157
+ - ++datasets.vla_data.latency_curriculum.enabled=false
158
+ - ++datasets.vla_data.latency_curriculum.strategy=exclusive
159
+ - ++datasets.vla_data.latency_curriculum.latencies=null
160
+ - ++datasets.vla_data.latency_curriculum.phase_steps=null
161
+ - ++datasets.vla_data.latency_curriculum.phase_distributions=null
162
+ - ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
163
+ - ++datasets.vla_data.latency_curriculum.replay_passes=0.25
164
+ - ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
165
+ - ++datasets.vla_data.latency_curriculum.final_equalization=true
166
+ - ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
167
+ - ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
168
+ - ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
169
+ - ++datasets.vla_data.latency_curriculum.computed_plan=null
170
+ - ++datasets.vla_data.per_device_batch_size=32
171
+ - ++datasets.vla_data.load_all_data_for_training=true
172
+ - ++datasets.vla_data.num_obs_frames=4
173
+ - ++datasets.vla_data.image_mode=stitch
174
+ - ++datasets.vla_data.prompt_mode=raw
175
+ - ++datasets.vla_data.stitch_grid=[2,2]
176
+ - ++datasets.vla_data.obs_image_size=null
177
+ - ++datasets.vla_data.video_backend=torchvision_av
178
+ - ++dataset.source_hf=
179
+ - ++dataset.config_name=null
180
+ - ++dataset.source_subdir=null
181
+ - ++dataset.converted_name=flappy_train
182
+ - ++dataset.single_source_hf=
183
+ - ++dataset.mixed_source_hf=
184
+ - ++dataset.single_converted_name=flappy_train
185
+ - ++dataset.mixed_converted_name=flappy_mixed_latency_train
186
+ - ++dataset.single_latency_filter=null
187
+ - ++dataset.mixed_latency_filter=null
188
+ - ++dataset.force_download=false
189
+ - ++dataset.setup_force=false
190
+ - ++dataset.skip_verification=false
191
+ - ++dataset.verify_rows=200
192
+ - ++dataset.max_episodes=null
193
+ - ++dataset.episodes_per_latency=null
194
+ - ++dataset.latency_filter=null
195
+ - ++dataset.debug_subset.enabled=false
196
+ - ++dataset.debug_subset.max_episodes=5
197
+ - ++dataset.debug_subset.suffix=debug
198
+ - ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
199
+ - ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
200
+ - ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
201
+ - ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
202
+ - trainer.max_train_steps=4000
203
+ - trainer.num_warmup_steps=100
204
+ - trainer.save_interval=500
205
+ - trainer.eval_interval=250
206
+ - trainer.eval_num_batches=50
207
+ - trainer.per_latency_eval_num_batches=null
208
+ - trainer.eval_action_classification=false
209
+ - trainer.eval_action_classification_interval=null
210
+ - trainer.cc_f1_tolerance=1
211
+ - trainer.learning_rate.base=2e-05
212
+ - trainer.learning_rate.qwen_vl_interface=1e-05
213
+ - trainer.learning_rate.action_model=0.0001
214
+ - trainer.lr_scheduler_type=cosine_with_min_lr
215
+ - trainer.scheduler_specific_kwargs.min_lr=1e-06
216
+ - trainer.freeze_modules=
217
+ - trainer.freeze_vit=false
218
+ - trainer.freeze_tied_embedding=false
219
+ - trainer.freeze_llm_layers=[]
220
+ - trainer.loss_scale.vla=1.0
221
+ - trainer.loss_scale.vlm=0.1
222
+ - trainer.max_grad_norm=1.0
223
+ - trainer.weight_decay=0.0
224
+ - trainer.logging_frequency=1
225
+ - trainer.profile_timing.enabled=false
226
+ - trainer.profile_timing.log_interval=10
227
+ - trainer.gradient_clipping=1.0
228
+ - trainer.gradient_accumulation_steps=2
229
+ - trainer.distributed_backend=deepspeed
230
+ - trainer.is_resume=false
231
+ - trainer.pretrained_checkpoint=null
232
+ - trainer.resume_step=0
233
+ - trainer.reload_modules=null
234
+ - trainer.optimizer.name=AdamW
235
+ - trainer.optimizer.betas=[0.9,0.95]
236
+ - trainer.optimizer.eps=1e-08
237
+ - trainer.optimizer.weight_decay=1e-08
238
+ - trainer.optimizer.fused=true
239
+ - trainer.save_format=pt
240
+ - ++workspace_dir=WORKSPACE_DIR
241
+ - ++run_root_dir=results/Checkpoints
242
+ - ++seed=42
243
+ - ++wandb_entity=saberrr-zju
244
+ - ++wandb_project=starVLA_rl_games
245
+ - ++auth.env_file=null
246
+ - ++auth.hf_token_env=HF_TOKEN
247
+ - ++auth.wandb_api_key_env=WANDB_API_KEY
248
+ - ++paths.run_root_dir=results/Checkpoints
249
+ - ++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps
250
+ - ++paths.dataset_cache_dir=null
251
+ - ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
252
+ - ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
253
+ - ++rl_games.model_alias=openvla
254
+ - ++rl_games.env_eval.image_size=224
255
+ - ++rl_games.env_eval.frameskip=1
256
+ - ++rl_games.env_eval.image_transform=raw_rgb
257
+ - ++rl_games.env_eval.prompt_mode=raw
258
+ - ++rl_games.env_eval.ghost_trail.history_frames=5
259
+ - ++rl_games.env_eval.ghost_trail.gamma=1.3
260
+ - ++rl_games.env_eval.ghost_trail.min_alpha=35
261
+ - ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
262
+ - ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
263
+ - ++rl_games.env_eval.seed=42
264
+ - ++rl_games.env_eval.fixed_episode_seeds=true
265
+ - ++rl_games.env_eval.latency_seed_stride=0
266
+ - ++rl_games.env_eval.task_seed_stride=0
267
+ - ++rl_games.env_eval.task_description=
268
+ - ++rl_games.env_eval.eval_parallel_envs=5
269
+ - ++rl_games.env_eval.enabled=true
270
+ - ++rl_games.env_eval.eval_backend=latency_bench
271
+ - ++rl_games.env_eval.distributed_mode=rank_sharded
272
+ - ++rl_games.env_eval.vectorized.enabled=false
273
+ - ++rl_games.env_eval.vectorized.batch_size=1
274
+ - ++rl_games.env_eval.latency.prompt_map_path=null
275
+ - ++rl_games.env_eval.latency.mode=single
276
+ - ++rl_games.env_eval.latency.values=[0]
277
+ - ++rl_games.env_eval.mid_train.enabled=true
278
+ - ++rl_games.env_eval.mid_train.interval_steps=250
279
+ - ++rl_games.env_eval.mid_train.latencies=[2]
280
+ - ++rl_games.env_eval.mid_train.num_episodes=20
281
+ - ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
282
+ - ++rl_games.env_eval.post_train.enabled=true
283
+ - ++rl_games.env_eval.post_train.latencies=[2]
284
+ - ++rl_games.env_eval.post_train.num_episodes=50
285
+ - ++rl_games.env_eval.post_train.max_steps_per_episode=3600
286
+ - ++rl_games.task=flappy
287
+ - ++rl_games.initialization_mode=bridge
288
+ - ++rl_games.action_carrier=bridge
289
+ - ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
290
+ - ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
291
+ - ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
292
+ - ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
293
+ - ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
294
+ - ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
295
+ - ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
296
+ - ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
297
+ - ++checkpoint.load=none
298
+ - ++checkpoint.hf_repo_id=null
299
+ - ++checkpoint.save_best_model=false
300
+ - ++checkpoint.save_final_model=true
301
+ - ++checkpoint.save_pt_file=false
302
+ - ++checkpoint.save_safetensors_file=true
303
+ - ++checkpoint.local.keep_last_n=1
304
+ - ++checkpoint.sync.enabled=false
305
+ - ++checkpoint.sync.repo_id=null
306
+ - ++checkpoint.sync.keep_last_n=0
307
+ - ++checkpoint.sync.sync_every_n_checkpoints=1
308
+ - ++checkpoint.sync.resume_policy=local_latest
309
+ - ++run_id=flappy_fix_latency_2_200ep_7k2steps_stitch
310
+ - ++output_dir=null
311
+ - ++config_yaml=null
312
+ - ++is_debug=false
313
+ - ++version_id=0.21
314
+ - ++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints
315
+ - trainer.is_resume=false
316
+ - trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
317
+ - trainer.resume_step=0
318
+ - ++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
319
+ - ++datasets.vla_data.data_mix=flappy_train__bridge
320
+ - ++datasets.vla_data.eval_data_mix=flappy_train__bridge__val
321
+ - ++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
322
+ - ++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
323
+ job:
324
+ name: train_starvla_hydra
325
+ chdir: false
326
+ override_dirname: ++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=none,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=flappy_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=flappy_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=flappy_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=flappy_train,++datasets.vla_data.data_mix=flappy_train__bridge,++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=flappy_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=stitch,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=4,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=32,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=2,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++framework.qwenvl.flex_backend=triton,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=1,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=true,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=true,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description=,++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=flappy,++run_id=flappy_fix_latency_2_200ep_7k2steps_stitch,++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++version_id=0.21,++wandb_entity=saberrr-zju,++wandb_project=starVLA_rl_games,++workspace_dir=WORKSPACE_DIR,env=flappy,init=bridge,mode=single,model=openvla,trainer.cc_f1_tolerance=1,trainer.distributed_backend=deepspeed,trainer.eval_action_classification=false,trainer.eval_action_classification_interval=null,trainer.eval_interval=250,trainer.eval_num_batches=50,trainer.freeze_llm_layers=[],trainer.freeze_modules=,trainer.freeze_tied_embedding=false,trainer.freeze_vit=false,trainer.gradient_accumulation_steps=2,trainer.gradient_clipping=1.0,trainer.is_resume=false,trainer.is_resume=false,trainer.learning_rate.action_model=0.0001,trainer.learning_rate.base=2e-05,trainer.learning_rate.qwen_vl_interface=1e-05,trainer.logging_frequency=1,trainer.loss_scale.vla=1.0,trainer.loss_scale.vlm=0.1,trainer.lr_scheduler_type=cosine_with_min_lr,trainer.max_grad_norm=1.0,trainer.max_train_steps=4000,trainer.num_warmup_steps=100,trainer.optimizer.betas=[0.9,0.95],trainer.optimizer.eps=1e-08,trainer.optimizer.fused=true,trainer.optimizer.name=AdamW,trainer.optimizer.weight_decay=1e-08,trainer.per_latency_eval_num_batches=null,trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt,trainer.pretrained_checkpoint=null,trainer.profile_timing.enabled=false,trainer.profile_timing.log_interval=10,trainer.reload_modules=null,trainer.resume_step=0,trainer.resume_step=0,trainer.save_format=pt,trainer.save_interval=500,trainer.scheduler_specific_kwargs.min_lr=1e-06,trainer.weight_decay=0.0
327
+ id: ???
328
+ num: ???
329
+ config_name: train
330
+ env_set: {}
331
+ env_copy: []
332
+ config:
333
+ override_dirname:
334
+ kv_sep: '='
335
+ item_sep: ','
336
+ exclude_keys: []
337
+ runtime:
338
+ version: 1.3.3
339
+ version_base: '1.1'
340
+ cwd: /workspace/latency-sensitive-bench/starVLA
341
+ config_sources:
342
+ - path: hydra.conf
343
+ schema: pkg
344
+ provider: hydra
345
+ - path: /workspace/latency-sensitive-bench/starVLA/examples/rl_games/config
346
+ schema: file
347
+ provider: main
348
+ - path: ''
349
+ schema: structured
350
+ provider: schema
351
+ output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/hydra
352
+ choices:
353
+ cross_task_setup: null
354
+ checkpoint: default
355
+ mode: single
356
+ init: bridge
357
+ env: flappy
358
+ model: openvla
359
+ hydra/env: default
360
+ hydra/callbacks: null
361
+ hydra/job_logging: default
362
+ hydra/hydra_logging: default
363
+ hydra/hydra_help: default
364
+ hydra/help: default
365
+ hydra/sweeper: basic
366
+ hydra/launcher: basic
367
+ hydra/output: default
368
+ verbose: false
flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/overrides.yaml ADDED
@@ -0,0 +1,208 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ - model=openvla
2
+ - env=flappy
3
+ - init=bridge
4
+ - mode=single
5
+ - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
6
+ - ++framework.qwenvl.attn_implementation=flash_attention_2
7
+ - ++framework.qwenvl.flex_backend=triton
8
+ - ++framework.qwenvl.enable_gradient_checkpointing=true
9
+ - ++framework.action_model.state_dim=7
10
+ - ++framework.action_model.loss_type=discrete_ce
11
+ - ++framework.action_model.action_horizon=1
12
+ - ++framework.action_model.future_action_window_size=0
13
+ - ++framework.action_model.past_action_window_size=0
14
+ - ++framework.action_model.action_dim=7
15
+ - ++framework.action_model.action_env_dim=2
16
+ - ++framework.kv_memory.enabled=false
17
+ - ++framework.kv_memory.window=4
18
+ - ++framework.kv_memory.rollout_len=8
19
+ - ++framework.kv_memory.packed_train=false
20
+ - ++framework.kv_memory.rebased_sink=true
21
+ - ++framework.name=QwenOFT
22
+ - ++datasets.vla_data.dataset_py=lerobot_datasets
23
+ - ++datasets.vla_data.include_state=true
24
+ - ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
25
+ - ++datasets.vla_data.data_mix=flappy_train
26
+ - ++datasets.vla_data.eval_data_mix=null
27
+ - ++datasets.vla_data.custom_mixtures_path=null
28
+ - ++datasets.vla_data.action_type=discrete
29
+ - ++datasets.vla_data.sequential_step_sampling=false
30
+ - ++datasets.vla_data.eval_sequential_step_sampling=null
31
+ - ++datasets.vla_data.num_workers=8
32
+ - ++datasets.vla_data.eval_num_workers=8
33
+ - ++datasets.vla_data.prefetch_factor=4
34
+ - ++datasets.vla_data.persistent_workers=true
35
+ - ++datasets.vla_data.pin_memory=true
36
+ - ++datasets.vla_data.shuffle=true
37
+ - ++datasets.vla_data.action_balance.enabled=false
38
+ - ++datasets.vla_data.action_balance.strategy=balanced_epoch
39
+ - ++datasets.vla_data.action_balance.action_key=action_id
40
+ - ++datasets.vla_data.action_balance.target_flap_fraction=0.3
41
+ - ++datasets.vla_data.action_balance.noop_id=0
42
+ - ++datasets.vla_data.action_balance.flap_id=1
43
+ - ++datasets.vla_data.latency_curriculum.enabled=false
44
+ - ++datasets.vla_data.latency_curriculum.strategy=exclusive
45
+ - ++datasets.vla_data.latency_curriculum.latencies=null
46
+ - ++datasets.vla_data.latency_curriculum.phase_steps=null
47
+ - ++datasets.vla_data.latency_curriculum.phase_distributions=null
48
+ - ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
49
+ - ++datasets.vla_data.latency_curriculum.replay_passes=0.25
50
+ - ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
51
+ - ++datasets.vla_data.latency_curriculum.final_equalization=true
52
+ - ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
53
+ - ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
54
+ - ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
55
+ - ++datasets.vla_data.latency_curriculum.computed_plan=null
56
+ - ++datasets.vla_data.per_device_batch_size=32
57
+ - ++datasets.vla_data.load_all_data_for_training=true
58
+ - ++datasets.vla_data.num_obs_frames=4
59
+ - ++datasets.vla_data.image_mode=stitch
60
+ - ++datasets.vla_data.prompt_mode=raw
61
+ - ++datasets.vla_data.stitch_grid=[2,2]
62
+ - ++datasets.vla_data.obs_image_size=null
63
+ - ++datasets.vla_data.video_backend=torchvision_av
64
+ - ++dataset.source_hf=
65
+ - ++dataset.config_name=null
66
+ - ++dataset.source_subdir=null
67
+ - ++dataset.converted_name=flappy_train
68
+ - ++dataset.single_source_hf=
69
+ - ++dataset.mixed_source_hf=
70
+ - ++dataset.single_converted_name=flappy_train
71
+ - ++dataset.mixed_converted_name=flappy_mixed_latency_train
72
+ - ++dataset.single_latency_filter=null
73
+ - ++dataset.mixed_latency_filter=null
74
+ - ++dataset.force_download=false
75
+ - ++dataset.setup_force=false
76
+ - ++dataset.skip_verification=false
77
+ - ++dataset.verify_rows=200
78
+ - ++dataset.max_episodes=null
79
+ - ++dataset.episodes_per_latency=null
80
+ - ++dataset.latency_filter=null
81
+ - ++dataset.debug_subset.enabled=false
82
+ - ++dataset.debug_subset.max_episodes=5
83
+ - ++dataset.debug_subset.suffix=debug
84
+ - ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
85
+ - ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
86
+ - ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
87
+ - ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
88
+ - trainer.max_train_steps=4000
89
+ - trainer.num_warmup_steps=100
90
+ - trainer.save_interval=500
91
+ - trainer.eval_interval=250
92
+ - trainer.eval_num_batches=50
93
+ - trainer.per_latency_eval_num_batches=null
94
+ - trainer.eval_action_classification=false
95
+ - trainer.eval_action_classification_interval=null
96
+ - trainer.cc_f1_tolerance=1
97
+ - trainer.learning_rate.base=2e-05
98
+ - trainer.learning_rate.qwen_vl_interface=1e-05
99
+ - trainer.learning_rate.action_model=0.0001
100
+ - trainer.lr_scheduler_type=cosine_with_min_lr
101
+ - trainer.scheduler_specific_kwargs.min_lr=1e-06
102
+ - trainer.freeze_modules=
103
+ - trainer.freeze_vit=false
104
+ - trainer.freeze_tied_embedding=false
105
+ - trainer.freeze_llm_layers=[]
106
+ - trainer.loss_scale.vla=1.0
107
+ - trainer.loss_scale.vlm=0.1
108
+ - trainer.max_grad_norm=1.0
109
+ - trainer.weight_decay=0.0
110
+ - trainer.logging_frequency=1
111
+ - trainer.profile_timing.enabled=false
112
+ - trainer.profile_timing.log_interval=10
113
+ - trainer.gradient_clipping=1.0
114
+ - trainer.gradient_accumulation_steps=2
115
+ - trainer.distributed_backend=deepspeed
116
+ - trainer.is_resume=false
117
+ - trainer.pretrained_checkpoint=null
118
+ - trainer.resume_step=0
119
+ - trainer.reload_modules=null
120
+ - trainer.optimizer.name=AdamW
121
+ - trainer.optimizer.betas=[0.9,0.95]
122
+ - trainer.optimizer.eps=1e-08
123
+ - trainer.optimizer.weight_decay=1e-08
124
+ - trainer.optimizer.fused=true
125
+ - trainer.save_format=pt
126
+ - ++workspace_dir=WORKSPACE_DIR
127
+ - ++run_root_dir=results/Checkpoints
128
+ - ++seed=42
129
+ - ++wandb_entity=saberrr-zju
130
+ - ++wandb_project=starVLA_rl_games
131
+ - ++auth.env_file=null
132
+ - ++auth.hf_token_env=HF_TOKEN
133
+ - ++auth.wandb_api_key_env=WANDB_API_KEY
134
+ - ++paths.run_root_dir=results/Checkpoints
135
+ - ++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps
136
+ - ++paths.dataset_cache_dir=null
137
+ - ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
138
+ - ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
139
+ - ++rl_games.model_alias=openvla
140
+ - ++rl_games.env_eval.image_size=224
141
+ - ++rl_games.env_eval.frameskip=1
142
+ - ++rl_games.env_eval.image_transform=raw_rgb
143
+ - ++rl_games.env_eval.prompt_mode=raw
144
+ - ++rl_games.env_eval.ghost_trail.history_frames=5
145
+ - ++rl_games.env_eval.ghost_trail.gamma=1.3
146
+ - ++rl_games.env_eval.ghost_trail.min_alpha=35
147
+ - ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
148
+ - ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
149
+ - ++rl_games.env_eval.seed=42
150
+ - ++rl_games.env_eval.fixed_episode_seeds=true
151
+ - ++rl_games.env_eval.latency_seed_stride=0
152
+ - ++rl_games.env_eval.task_seed_stride=0
153
+ - ++rl_games.env_eval.task_description=
154
+ - ++rl_games.env_eval.eval_parallel_envs=5
155
+ - ++rl_games.env_eval.enabled=true
156
+ - ++rl_games.env_eval.eval_backend=latency_bench
157
+ - ++rl_games.env_eval.distributed_mode=rank_sharded
158
+ - ++rl_games.env_eval.vectorized.enabled=false
159
+ - ++rl_games.env_eval.vectorized.batch_size=1
160
+ - ++rl_games.env_eval.latency.prompt_map_path=null
161
+ - ++rl_games.env_eval.latency.mode=single
162
+ - ++rl_games.env_eval.latency.values=[0]
163
+ - ++rl_games.env_eval.mid_train.enabled=true
164
+ - ++rl_games.env_eval.mid_train.interval_steps=250
165
+ - ++rl_games.env_eval.mid_train.latencies=[2]
166
+ - ++rl_games.env_eval.mid_train.num_episodes=20
167
+ - ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
168
+ - ++rl_games.env_eval.post_train.enabled=true
169
+ - ++rl_games.env_eval.post_train.latencies=[2]
170
+ - ++rl_games.env_eval.post_train.num_episodes=50
171
+ - ++rl_games.env_eval.post_train.max_steps_per_episode=3600
172
+ - ++rl_games.task=flappy
173
+ - ++rl_games.initialization_mode=bridge
174
+ - ++rl_games.action_carrier=bridge
175
+ - ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
176
+ - ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
177
+ - ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
178
+ - ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
179
+ - ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
180
+ - ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
181
+ - ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
182
+ - ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
183
+ - ++checkpoint.load=none
184
+ - ++checkpoint.hf_repo_id=null
185
+ - ++checkpoint.save_best_model=false
186
+ - ++checkpoint.save_final_model=true
187
+ - ++checkpoint.save_pt_file=false
188
+ - ++checkpoint.save_safetensors_file=true
189
+ - ++checkpoint.local.keep_last_n=1
190
+ - ++checkpoint.sync.enabled=false
191
+ - ++checkpoint.sync.repo_id=null
192
+ - ++checkpoint.sync.keep_last_n=0
193
+ - ++checkpoint.sync.sync_every_n_checkpoints=1
194
+ - ++checkpoint.sync.resume_policy=local_latest
195
+ - ++run_id=flappy_fix_latency_2_200ep_7k2steps_stitch
196
+ - ++output_dir=null
197
+ - ++config_yaml=null
198
+ - ++is_debug=false
199
+ - ++version_id=0.21
200
+ - ++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints
201
+ - trainer.is_resume=false
202
+ - trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
203
+ - trainer.resume_step=0
204
+ - ++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
205
+ - ++datasets.vla_data.data_mix=flappy_train__bridge
206
+ - ++datasets.vla_data.eval_data_mix=flappy_train__bridge__val
207
+ - ++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
208
+ - ++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/train_starvla_hydra.log ADDED
The diff for this file is too large to render. See raw diff
 
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 6.500000096857548, "episode_return_env": 6.500000096857548, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 67, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 67}
2
+ {"episode_id": 2, "episode_return": 174.80000206828117, "episode_return_env": 174.80000206828117, "game_score": 37.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1426, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1426}
3
+ {"episode_id": 4, "episode_return": 127.50000151246786, "episode_return_env": 127.50000151246786, "game_score": 27.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1043, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1043}
4
+ {"episode_id": 6, "episode_return": 288.4000034034252, "episode_return_env": 288.4000034034252, "game_score": 61.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2346, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2346}
5
+ {"episode_id": 8, "episode_return": 6.70000009983778, "episode_return_env": 6.70000009983778, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 69, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 69}
6
+ {"episode_id": 10, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
7
+ {"episode_id": 12, "episode_return": 138.90000165253878, "episode_return_env": 138.90000165253878, "game_score": 29.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1139, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1139}
8
+ {"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 16, "episode_return": 249.00000293552876, "episode_return_env": 249.00000293552876, "game_score": 53.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2024, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2024}
10
+ {"episode_id": 18, "episode_return": 190.4000022560358, "episode_return_env": 190.4000022560358, "game_score": 40.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1555, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1555}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 1, "episode_return": 113.50000134855509, "episode_return_env": 113.50000134855509, "game_score": 24.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 930, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 930}
2
+ {"episode_id": 3, "episode_return": 393.50000462681055, "episode_return_env": 393.50000462681055, "game_score": 84.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3190, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3190}
3
+ {"episode_id": 5, "episode_return": 46.800000578165054, "episode_return_env": 46.800000578165054, "game_score": 9.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 398, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 398}
4
+ {"episode_id": 7, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 9, "episode_return": 342.5000040307641, "episode_return_env": 342.5000040307641, "game_score": 73.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2779, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2779}
6
+ {"episode_id": 11, "episode_return": 37.300000466406345, "episode_return_env": 37.300000466406345, "game_score": 7.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 321, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 321}
7
+ {"episode_id": 13, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
8
+ {"episode_id": 15, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 17, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 19, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 1, "episode_return": 113.50000134855509, "episode_return_env": 113.50000134855509, "game_score": 24.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 930, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 930}
2
+ {"episode_id": 3, "episode_return": 67.0000008046627, "episode_return_env": 67.0000008046627, "game_score": 14.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 555, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 555}
3
+ {"episode_id": 5, "episode_return": 244.5000028833747, "episode_return_env": 244.5000028833747, "game_score": 52.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1988, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1988}
4
+ {"episode_id": 7, "episode_return": 155.5000018402934, "episode_return_env": 155.5000018402934, "game_score": 33.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1269, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1269}
5
+ {"episode_id": 9, "episode_return": 6.800000101327896, "episode_return_env": 6.800000101327896, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 70, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 70}
6
+ {"episode_id": 11, "episode_return": 85.50000102072954, "episode_return_env": 85.50000102072954, "game_score": 18.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 704, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 704}
7
+ {"episode_id": 13, "episode_return": 333.1000039204955, "episode_return_env": 333.1000039204955, "game_score": 71.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2703, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2703}
8
+ {"episode_id": 15, "episode_return": 43.80000053346157, "episode_return_env": 43.80000053346157, "game_score": 9.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 368, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 368}
9
+ {"episode_id": 17, "episode_return": 291.0000034272671, "episode_return_env": 291.0000034272671, "game_score": 62.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2363, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2363}
10
+ {"episode_id": 19, "episode_return": 6.800000101327896, "episode_return_env": 6.800000101327896, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 70, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 70}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 1, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 3, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 5, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 7, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 9, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
6
+ {"episode_id": 11, "episode_return": 272.50000321120024, "episode_return_env": 272.50000321120024, "game_score": 58.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2214, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2214}
7
+ {"episode_id": 13, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
8
+ {"episode_id": 15, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 17, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 19, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 4, "episode_return": 440.80000518262386, "episode_return_env": 440.80000518262386, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3573, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3573}
4
+ {"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 8, "episode_return": 180.9000021442771, "episode_return_env": 180.9000021442771, "game_score": 38.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1478, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1478}
6
+ {"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
7
+ {"episode_id": 12, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
8
+ {"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 18, "episode_return": 160.8000019043684, "episode_return_env": 160.8000019043684, "game_score": 34.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1313, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1313}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 8, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
6
+ {"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
7
+ {"episode_id": 12, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
8
+ {"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 18, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
2
+ {"episode_id": 2, "episode_return": 4.4000000804662704, "episode_return_env": 4.4000000804662704, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 55, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 55}
3
+ {"episode_id": 4, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
4
+ {"episode_id": 6, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
5
+ {"episode_id": 8, "episode_return": 4.200000077486038, "episode_return_env": 4.200000077486038, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 53, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 53}
6
+ {"episode_id": 10, "episode_return": 4.300000078976154, "episode_return_env": 4.300000078976154, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 54, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 54}
7
+ {"episode_id": 12, "episode_return": 6.200000092387199, "episode_return_env": 6.200000092387199, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 64, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 64}
8
+ {"episode_id": 14, "episode_return": 6.200000092387199, "episode_return_env": 6.200000092387199, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 64, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 64}
9
+ {"episode_id": 16, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
10
+ {"episode_id": 18, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2500/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}