Caesarrr commited on
Commit
4d5e2a5
·
verified ·
1 Parent(s): fbc31e1

Upload folder using huggingface_hub

Browse files
This view is limited to 50 files because it contains too many changes.   See raw diff
Files changed (50) hide show
  1. .gitattributes +1 -0
  2. flappy_fix_latency_2_200ep_7k2steps_single_baseline/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt +3 -0
  3. flappy_fix_latency_2_200ep_7k2steps_single_baseline/checkpoints/steps_4000_model.safetensors +3 -0
  4. flappy_fix_latency_2_200ep_7k2steps_single_baseline/config.full.yaml +249 -0
  5. flappy_fix_latency_2_200ep_7k2steps_single_baseline/config.yaml +102 -0
  6. flappy_fix_latency_2_200ep_7k2steps_single_baseline/dataset_statistics.json +127 -0
  7. flappy_fix_latency_2_200ep_7k2steps_single_baseline/dataset_statistics_eval.json +127 -0
  8. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_1000.json +120 -0
  9. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_1250.json +120 -0
  10. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_1500.json +120 -0
  11. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_1750.json +120 -0
  12. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_2000.json +120 -0
  13. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_2250.json +120 -0
  14. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_250.json +120 -0
  15. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_2500.json +120 -0
  16. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_2750.json +120 -0
  17. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_3000.json +120 -0
  18. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_3250.json +120 -0
  19. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_3500.json +120 -0
  20. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_3750.json +120 -0
  21. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_4000.json +120 -0
  22. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_500.json +120 -0
  23. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_750.json +120 -0
  24. flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/post_train/step_4000.json +240 -0
  25. flappy_fix_latency_2_200ep_7k2steps_single_baseline/hydra/.hydra/config.yaml +247 -0
  26. flappy_fix_latency_2_200ep_7k2steps_single_baseline/hydra/.hydra/hydra.yaml +368 -0
  27. flappy_fix_latency_2_200ep_7k2steps_single_baseline/hydra/.hydra/overrides.yaml +208 -0
  28. flappy_fix_latency_2_200ep_7k2steps_single_baseline/hydra/train_starvla_hydra.log +0 -0
  29. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/_progress/rank_0.json +1 -0
  30. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/_progress/rank_1.json +1 -0
  31. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2/episode_metrics.jsonl +10 -0
  32. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/_progress/rank_0.json +1 -0
  33. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/_progress/rank_1.json +1 -0
  34. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2/episode_metrics.jsonl +10 -0
  35. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/_progress/rank_0.json +1 -0
  36. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/_progress/rank_1.json +1 -0
  37. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2/episode_metrics.jsonl +10 -0
  38. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/_progress/rank_0.json +1 -0
  39. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/_progress/rank_1.json +1 -0
  40. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2/episode_metrics.jsonl +10 -0
  41. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/_progress/rank_0.json +1 -0
  42. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/_progress/rank_1.json +1 -0
  43. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2/episode_metrics.jsonl +10 -0
  44. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/_progress/rank_0.json +1 -0
  45. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/_progress/rank_1.json +1 -0
  46. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2/episode_metrics.jsonl +10 -0
  47. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/_progress/rank_0.json +1 -0
  48. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/_progress/rank_1.json +1 -0
  49. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2/episode_metrics.jsonl +10 -0
  50. flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2500/_progress/rank_0.json +1 -0
.gitattributes CHANGED
@@ -34,3 +34,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
  flappy_fix_latency_2_200ep_7k2steps_kv_memory_flex/wandb/wandb/run-20260628_174516-d5o0ia06/run-d5o0ia06.wandb filter=lfs diff=lfs merge=lfs -text
 
 
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
  flappy_fix_latency_2_200ep_7k2steps_kv_memory_flex/wandb/wandb/run-20260628_174516-d5o0ia06/run-d5o0ia06.wandb filter=lfs diff=lfs merge=lfs -text
37
+ flappy_fix_latency_2_200ep_7k2steps_single_baseline/wandb/wandb/run-20260629_061046-mj819fop/run-mj819fop.wandb filter=lfs diff=lfs merge=lfs -text
flappy_fix_latency_2_200ep_7k2steps_single_baseline/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:371cb744227687bb99bcad7f9ff2250cf06da75631359ad3eba4c6bc52570607
3
+ size 9785060316
flappy_fix_latency_2_200ep_7k2steps_single_baseline/checkpoints/steps_4000_model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a92627efd00d16c3a3a392b46cc366ec06956b0e651f81951b1be5435cc75f37
3
+ size 9784896838
flappy_fix_latency_2_200ep_7k2steps_single_baseline/config.full.yaml ADDED
@@ -0,0 +1,249 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ framework:
2
+ name: QwenOFT
3
+ qwenvl:
4
+ base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
5
+ attn_implementation: flash_attention_2
6
+ flex_backend: triton
7
+ enable_gradient_checkpointing: true
8
+ action_model:
9
+ action_model_type: MLP
10
+ action_dim: 7
11
+ action_hidden_dim: 2560
12
+ future_action_window_size: 0
13
+ past_action_window_size: 0
14
+ loss_type: discrete_ce
15
+ state_dim: 7
16
+ action_horizon: 1
17
+ action_env_dim: 2
18
+ kv_memory:
19
+ enabled: false
20
+ window: 4
21
+ rollout_len: 8
22
+ packed_train: false
23
+ rebased_sink: true
24
+ datasets:
25
+ vla_data:
26
+ dataset_py: lerobot_datasets
27
+ include_state: true
28
+ data_root_dir: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
29
+ data_mix: flappy_train__bridge
30
+ eval_data_mix: flappy_train__bridge__val
31
+ custom_mixtures_path: null
32
+ action_type: discrete
33
+ sequential_step_sampling: false
34
+ eval_sequential_step_sampling: null
35
+ num_workers: 8
36
+ eval_num_workers: 8
37
+ prefetch_factor: 4
38
+ persistent_workers: true
39
+ pin_memory: true
40
+ shuffle: true
41
+ action_balance:
42
+ enabled: false
43
+ strategy: balanced_epoch
44
+ action_key: action_id
45
+ target_flap_fraction: 0.3
46
+ noop_id: 0
47
+ flap_id: 1
48
+ latency_curriculum:
49
+ enabled: false
50
+ strategy: exclusive
51
+ latencies: null
52
+ phase_steps: null
53
+ phase_distributions: null
54
+ new_latency_passes: 1.0
55
+ replay_passes: 0.25
56
+ target_total_passes: 2.0
57
+ final_equalization: true
58
+ step_budget_mode: auto
59
+ eval_at_phase_end: false
60
+ save_at_phase_end: false
61
+ computed_plan: null
62
+ per_device_batch_size: 32
63
+ load_all_data_for_training: true
64
+ num_obs_frames: 1
65
+ image_mode: single
66
+ prompt_mode: raw
67
+ stitch_grid:
68
+ - 2
69
+ - 2
70
+ obs_image_size: null
71
+ video_backend: torchvision_av
72
+ dataset:
73
+ source_hf: ''
74
+ config_name: null
75
+ source_subdir: null
76
+ converted_name: flappy_train
77
+ single_source_hf: ''
78
+ mixed_source_hf: ''
79
+ single_converted_name: flappy_train
80
+ mixed_converted_name: flappy_mixed_latency_train
81
+ single_latency_filter: null
82
+ mixed_latency_filter: null
83
+ force_download: false
84
+ setup_force: false
85
+ skip_verification: false
86
+ verify_rows: 200
87
+ max_episodes: null
88
+ episodes_per_latency: null
89
+ latency_filter: null
90
+ debug_subset:
91
+ enabled: false
92
+ max_episodes: 5
93
+ suffix: debug
94
+ base_model:
95
+ repo_id: Qwen/Qwen3-VL-4B-Instruct
96
+ initialization:
97
+ checkpoint_local_dir: playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
98
+ checkpoint_hf_repo_id: StarVLA/Qwen3VL-OFT-Bridge-RT-1
99
+ checkpoint_filename: checkpoints/steps_5000_pytorch_model.pt
100
+ trainer:
101
+ max_train_steps: 4000
102
+ num_warmup_steps: 100
103
+ save_interval: 500
104
+ eval_interval: 250
105
+ eval_num_batches: 50
106
+ per_latency_eval_num_batches: null
107
+ eval_action_classification: false
108
+ eval_action_classification_interval: null
109
+ cc_f1_tolerance: 1
110
+ learning_rate:
111
+ base: 2.0e-05
112
+ qwen_vl_interface: 1.0e-05
113
+ action_model: 0.0001
114
+ lr_scheduler_type: cosine_with_min_lr
115
+ scheduler_specific_kwargs:
116
+ min_lr: 1.0e-06
117
+ freeze_modules: ''
118
+ freeze_vit: false
119
+ freeze_tied_embedding: false
120
+ freeze_llm_layers: []
121
+ loss_scale:
122
+ vla: 1.0
123
+ vlm: 0.1
124
+ max_grad_norm: 1.0
125
+ weight_decay: 0.0
126
+ logging_frequency: 1
127
+ profile_timing:
128
+ enabled: false
129
+ log_interval: 10
130
+ gradient_clipping: 1.0
131
+ gradient_accumulation_steps: 2
132
+ distributed_backend: deepspeed
133
+ is_resume: false
134
+ pretrained_checkpoint: null
135
+ resume_step: 0
136
+ reload_modules: null
137
+ optimizer:
138
+ name: AdamW
139
+ betas:
140
+ - 0.9
141
+ - 0.95
142
+ eps: 1.0e-08
143
+ weight_decay: 1.0e-08
144
+ fused: true
145
+ save_format: pt
146
+ workspace_dir: WORKSPACE_DIR
147
+ run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
148
+ seed: 42
149
+ wandb_entity: saberrr-zju
150
+ wandb_project: starVLA_rl_games
151
+ auth:
152
+ env_file: null
153
+ hf_token_env: HF_TOKEN
154
+ wandb_api_key_env: WANDB_API_KEY
155
+ paths:
156
+ run_root_dir: results/Checkpoints
157
+ dataset_local_dir: data/flappy_fix_latency_2_200ep_7k2steps
158
+ dataset_cache_dir: null
159
+ base_model_dir: playground/Pretrained_models/Qwen3-VL-4B-Instruct
160
+ accelerate_config: starVLA/config/deepseeds/deepspeed_zero2.yaml
161
+ launch:
162
+ use_accelerate: true
163
+ gpus: null
164
+ num_processes: 1
165
+ dry_run: false
166
+ conda:
167
+ enabled: true
168
+ env_name: null
169
+ rl_games:
170
+ model_alias: openvla
171
+ env_eval:
172
+ image_size: 224
173
+ frameskip: 1
174
+ image_transform: raw_rgb
175
+ prompt_mode: raw
176
+ ghost_trail:
177
+ history_frames: 5
178
+ gamma: 1.3
179
+ min_alpha: 35
180
+ scroll_px_per_step: 4.0
181
+ ground_fraction: 0.22
182
+ seed: 42
183
+ fixed_episode_seeds: true
184
+ latency_seed_stride: 0
185
+ task_seed_stride: 0
186
+ task_description: ''
187
+ eval_parallel_envs: 5
188
+ enabled: true
189
+ eval_backend: latency_bench
190
+ distributed_mode: rank_sharded
191
+ vectorized:
192
+ enabled: false
193
+ batch_size: 1
194
+ latency:
195
+ prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
196
+ mode: single
197
+ values:
198
+ - 0
199
+ mid_train:
200
+ enabled: true
201
+ interval_steps: 250
202
+ latencies:
203
+ - 2
204
+ num_episodes: 20
205
+ max_steps_per_episode: 3600
206
+ post_train:
207
+ enabled: true
208
+ latencies:
209
+ - 2
210
+ num_episodes: 50
211
+ max_steps_per_episode: 3600
212
+ task: flappy
213
+ initialization_mode: bridge
214
+ action_carrier: bridge
215
+ model: openvla
216
+ env: flappy
217
+ init: bridge
218
+ bridge_base_model:
219
+ repo_id:
220
+ openvla: Qwen/Qwen3-VL-4B-Instruct
221
+ pi0: StarVLA/Qwen2.5-VL-3B-Instruct-Action
222
+ pi05: Qwen/Qwen3-VL-4B-Instruct
223
+ gr00t: Qwen/Qwen3-VL-4B-Instruct
224
+ local_dir:
225
+ openvla: playground/Pretrained_models/Qwen3-VL-4B-Instruct
226
+ pi0: playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
227
+ pi05: playground/Pretrained_models/Qwen3-VL-4B-Instruct
228
+ gr00t: playground/Pretrained_models/Qwen3-VL-4B-Instruct
229
+ mode: single
230
+ checkpoint:
231
+ load: none
232
+ hf_repo_id: null
233
+ save_best_model: false
234
+ save_final_model: true
235
+ save_pt_file: false
236
+ save_safetensors_file: true
237
+ local:
238
+ keep_last_n: 1
239
+ sync:
240
+ enabled: false
241
+ repo_id: null
242
+ keep_last_n: 0
243
+ sync_every_n_checkpoints: 1
244
+ resume_policy: local_latest
245
+ run_id: flappy_fix_latency_2_200ep_7k2steps_single_baseline
246
+ output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline
247
+ config_yaml: null
248
+ is_debug: false
249
+ version_id: '0.21'
flappy_fix_latency_2_200ep_7k2steps_single_baseline/config.yaml ADDED
@@ -0,0 +1,102 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ checkpoint:
2
+ local:
3
+ keep_last_n: 1
4
+ save_best_model: false
5
+ save_final_model: true
6
+ save_pt_file: false
7
+ save_safetensors_file: true
8
+ sync:
9
+ enabled: false
10
+ keep_last_n: 0
11
+ repo_id: null
12
+ datasets:
13
+ vla_data:
14
+ data_mix: flappy_train__bridge
15
+ dataset_py: lerobot_datasets
16
+ eval_data_mix: flappy_train__bridge__val
17
+ latency_curriculum:
18
+ enabled: false
19
+ obs_image_size: null
20
+ per_device_batch_size: 32
21
+ framework:
22
+ action_model:
23
+ action_dim: 7
24
+ action_env_dim: 2
25
+ action_hidden_dim: 2560
26
+ action_horizon: 1
27
+ action_model_type: MLP
28
+ loss_type: discrete_ce
29
+ kv_memory:
30
+ enabled: false
31
+ packed_train: false
32
+ rebased_sink: true
33
+ rollout_len: 8
34
+ window: 4
35
+ name: QwenOFT
36
+ qwenvl:
37
+ attn_implementation: flash_attention_2
38
+ base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
39
+ enable_gradient_checkpointing: true
40
+ output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline
41
+ rl_games:
42
+ env_eval:
43
+ distributed_mode: rank_sharded
44
+ enabled: true
45
+ eval_backend: latency_bench
46
+ eval_parallel_envs: 5
47
+ fixed_episode_seeds: true
48
+ image_size: 224
49
+ image_transform: raw_rgb
50
+ latency:
51
+ prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
52
+ mid_train:
53
+ enabled: true
54
+ interval_steps: 250
55
+ latencies:
56
+ - 2
57
+ max_steps_per_episode: 3600
58
+ num_episodes: 20
59
+ prompt_mode: raw
60
+ seed: 42
61
+ model_alias: openvla
62
+ task: flappy
63
+ run_id: flappy_fix_latency_2_200ep_7k2steps_single_baseline
64
+ run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
65
+ seed: 42
66
+ trainer:
67
+ distributed_backend: deepspeed
68
+ eval_action_classification: false
69
+ eval_action_classification_interval: null
70
+ eval_interval: 250
71
+ eval_num_batches: 50
72
+ freeze_llm_layers: []
73
+ freeze_modules: ''
74
+ freeze_tied_embedding: false
75
+ freeze_vit: false
76
+ gradient_accumulation_steps: 2
77
+ is_resume: false
78
+ learning_rate:
79
+ action_model: 0.0001
80
+ base: 2.0e-05
81
+ qwen_vl_interface: 1.0e-05
82
+ logging_frequency: 1
83
+ lr_scheduler_type: cosine_with_min_lr
84
+ max_train_steps: 4000
85
+ num_warmup_steps: 100
86
+ optimizer:
87
+ betas:
88
+ - 0.9
89
+ - 0.95
90
+ eps: 1.0e-08
91
+ fused: true
92
+ weight_decay: 1.0e-08
93
+ per_latency_eval_num_batches: null
94
+ pretrained_checkpoint: null
95
+ profile_timing:
96
+ enabled: false
97
+ reload_modules: null
98
+ save_interval: 500
99
+ scheduler_specific_kwargs:
100
+ min_lr: 1.0e-06
101
+ wandb_entity: saberrr-zju
102
+ wandb_project: starVLA_rl_games
flappy_fix_latency_2_200ep_7k2steps_single_baseline/dataset_statistics.json ADDED
@@ -0,0 +1,127 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "new_embodiment": {
3
+ "action": {
4
+ "mean": [
5
+ 0.8029062747955322,
6
+ 0.19709371030330658,
7
+ 0.0,
8
+ 0.0,
9
+ 0.0,
10
+ 0.0,
11
+ 0.0
12
+ ],
13
+ "std": [
14
+ 0.395094633102417,
15
+ 0.395094633102417,
16
+ 0.0,
17
+ 0.0,
18
+ 0.0,
19
+ 0.0,
20
+ 0.0
21
+ ],
22
+ "max": [
23
+ 1.0,
24
+ 1.0,
25
+ 0.0,
26
+ 0.0,
27
+ 0.0,
28
+ 0.0,
29
+ 0.0
30
+ ],
31
+ "min": [
32
+ 0.0,
33
+ 0.0,
34
+ 0.0,
35
+ 0.0,
36
+ 0.0,
37
+ 0.0,
38
+ 0.0
39
+ ],
40
+ "q01": [
41
+ 0.0,
42
+ 0.0,
43
+ 0.0,
44
+ 0.0,
45
+ 0.0,
46
+ 0.0,
47
+ 0.0
48
+ ],
49
+ "q99": [
50
+ 1.0,
51
+ 1.0,
52
+ 0.0,
53
+ 0.0,
54
+ 0.0,
55
+ 0.0,
56
+ 0.0
57
+ ],
58
+ "mask": [
59
+ true,
60
+ true,
61
+ true,
62
+ true,
63
+ true,
64
+ true,
65
+ true
66
+ ]
67
+ },
68
+ "state": {
69
+ "mean": [
70
+ 0.0,
71
+ 0.0,
72
+ 0.0,
73
+ 0.0,
74
+ 0.0,
75
+ 0.0,
76
+ 0.0
77
+ ],
78
+ "std": [
79
+ 0.0,
80
+ 0.0,
81
+ 0.0,
82
+ 0.0,
83
+ 0.0,
84
+ 0.0,
85
+ 0.0
86
+ ],
87
+ "max": [
88
+ 0.0,
89
+ 0.0,
90
+ 0.0,
91
+ 0.0,
92
+ 0.0,
93
+ 0.0,
94
+ 0.0
95
+ ],
96
+ "min": [
97
+ 0.0,
98
+ 0.0,
99
+ 0.0,
100
+ 0.0,
101
+ 0.0,
102
+ 0.0,
103
+ 0.0
104
+ ],
105
+ "q01": [
106
+ 0.0,
107
+ 0.0,
108
+ 0.0,
109
+ 0.0,
110
+ 0.0,
111
+ 0.0,
112
+ 0.0
113
+ ],
114
+ "q99": [
115
+ 0.0,
116
+ 0.0,
117
+ 0.0,
118
+ 0.0,
119
+ 0.0,
120
+ 0.0,
121
+ 0.0
122
+ ]
123
+ },
124
+ "num_transitions": 1291269,
125
+ "num_trajectories": 180
126
+ }
127
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/dataset_statistics_eval.json ADDED
@@ -0,0 +1,127 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "new_embodiment": {
3
+ "action": {
4
+ "mean": [
5
+ 0.8033548593521118,
6
+ 0.19664514064788818,
7
+ 0.0,
8
+ 0.0,
9
+ 0.0,
10
+ 0.0,
11
+ 0.0
12
+ ],
13
+ "std": [
14
+ 0.39764848351478577,
15
+ 0.39764848351478577,
16
+ 0.0,
17
+ 0.0,
18
+ 0.0,
19
+ 0.0,
20
+ 0.0
21
+ ],
22
+ "max": [
23
+ 1.0,
24
+ 1.0,
25
+ 0.0,
26
+ 0.0,
27
+ 0.0,
28
+ 0.0,
29
+ 0.0
30
+ ],
31
+ "min": [
32
+ 0.0,
33
+ 0.0,
34
+ 0.0,
35
+ 0.0,
36
+ 0.0,
37
+ 0.0,
38
+ 0.0
39
+ ],
40
+ "q01": [
41
+ 0.0,
42
+ 0.0,
43
+ 0.0,
44
+ 0.0,
45
+ 0.0,
46
+ 0.0,
47
+ 0.0
48
+ ],
49
+ "q99": [
50
+ 1.0,
51
+ 1.0,
52
+ 0.0,
53
+ 0.0,
54
+ 0.0,
55
+ 0.0,
56
+ 0.0
57
+ ],
58
+ "mask": [
59
+ true,
60
+ true,
61
+ true,
62
+ true,
63
+ true,
64
+ true,
65
+ true
66
+ ]
67
+ },
68
+ "state": {
69
+ "mean": [
70
+ 0.0,
71
+ 0.0,
72
+ 0.0,
73
+ 0.0,
74
+ 0.0,
75
+ 0.0,
76
+ 0.0
77
+ ],
78
+ "std": [
79
+ 0.0,
80
+ 0.0,
81
+ 0.0,
82
+ 0.0,
83
+ 0.0,
84
+ 0.0,
85
+ 0.0
86
+ ],
87
+ "max": [
88
+ 0.0,
89
+ 0.0,
90
+ 0.0,
91
+ 0.0,
92
+ 0.0,
93
+ 0.0,
94
+ 0.0
95
+ ],
96
+ "min": [
97
+ 0.0,
98
+ 0.0,
99
+ 0.0,
100
+ 0.0,
101
+ 0.0,
102
+ 0.0,
103
+ 0.0
104
+ ],
105
+ "q01": [
106
+ 0.0,
107
+ 0.0,
108
+ 0.0,
109
+ 0.0,
110
+ 0.0,
111
+ 0.0,
112
+ 0.0
113
+ ],
114
+ "q99": [
115
+ 0.0,
116
+ 0.0,
117
+ 0.0,
118
+ 0.0,
119
+ 0.0,
120
+ 0.0,
121
+ 0.0
122
+ ]
123
+ },
124
+ "num_transitions": 143553,
125
+ "num_trajectories": 20
126
+ }
127
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_1000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 178.76000211760402,
7
+ "mean_length": 1459.45,
8
+ "std_reward": 143.96534612493693,
9
+ "std_length": 1160.510296162856,
10
+ "episode_rewards": [
11
+ 13.000000178813934,
12
+ 444.6000052243471,
13
+ 6.500000096857548,
14
+ 120.40000143647194,
15
+ 125.10000149160624,
16
+ 444.6000052243471,
17
+ 68.90000083297491,
18
+ 87.90000105649233,
19
+ 92.40000110864639,
20
+ 113.50000134855509,
21
+ 50.40000061690807,
22
+ 101.9000012204051,
23
+ 162.40000192821026,
24
+ 269.9000031873584,
25
+ 68.90000083297491,
26
+ 444.6000052243471,
27
+ 110.90000132471323,
28
+ 409.9000048264861,
29
+ 183.50000216811895,
30
+ 255.9000030234456
31
+ ],
32
+ "episode_lengths": [
33
+ 123,
34
+ 3600,
35
+ 67,
36
+ 990,
37
+ 1028,
38
+ 3600,
39
+ 574,
40
+ 728,
41
+ 764,
42
+ 930,
43
+ 425,
44
+ 841,
45
+ 1329,
46
+ 2197,
47
+ 574,
48
+ 3600,
49
+ 913,
50
+ 3327,
51
+ 1495,
52
+ 2084
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 178.76000211760402,
112
+ "mean_length": 1459.45,
113
+ "std_reward": 143.96534612493693,
114
+ "std_length": 1160.510296162856,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 178.76000211760402,
117
+ "macro_mean_length": 1459.45,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_1250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 358.5150042194873,
7
+ "mean_length": 2907.8,
8
+ "std_reward": 138.7391679550005,
9
+ "std_length": 1117.1651444616414,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 179.0000021159649,
13
+ 444.6000052243471,
14
+ 415.40000489354134,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 102.90000123530626,
22
+ 444.6000052243471,
23
+ 295.60000348091125,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 300.5000035390258,
27
+ 51.400000631809235,
28
+ 60.900000743567944,
29
+ 429.4000050574541,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 1459,
35
+ 3600,
36
+ 3373,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 851,
44
+ 3600,
45
+ 2400,
46
+ 3600,
47
+ 3600,
48
+ 2440,
49
+ 435,
50
+ 512,
51
+ 3486,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 358.5150042194873,
112
+ "mean_length": 2907.8,
113
+ "std_reward": 138.7391679550005,
114
+ "std_length": 1117.1651444616414,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 358.5150042194873,
117
+ "macro_mean_length": 2907.8,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_1500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 389.8650045845658,
7
+ "mean_length": 3159.25,
8
+ "std_reward": 132.53658621696005,
9
+ "std_length": 1068.461270940599,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 6.800000101327896,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 274.40000323951244,
28
+ 444.6000052243471,
29
+ 11.30000015348196,
30
+ 391.20000460743904
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 70,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 2233,
50
+ 3600,
51
+ 106,
52
+ 3176
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 389.8650045845658,
112
+ "mean_length": 3159.25,
113
+ "std_reward": 132.53658621696005,
114
+ "std_length": 1068.461270940599,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 389.8650045845658,
117
+ "macro_mean_length": 3159.25,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_1750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 262.4650030937046,
7
+ "mean_length": 2132.0,
8
+ "std_reward": 202.45606988720613,
9
+ "std_length": 1632.2904459684864,
10
+ "episode_rewards": [
11
+ 6.500000096857548,
12
+ 444.6000052243471,
13
+ 11.000000149011612,
14
+ 444.6000052243471,
15
+ 6.800000101327896,
16
+ 8.400000125169754,
17
+ 444.6000052243471,
18
+ 6.500000096857548,
19
+ 25.000000312924385,
20
+ 444.6000052243471,
21
+ 334.9000039473176,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 319.0000037550926,
25
+ 444.6000052243471,
26
+ 8.400000125169754,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 76.80000092089176,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 67,
34
+ 3600,
35
+ 103,
36
+ 3600,
37
+ 70,
38
+ 86,
39
+ 3600,
40
+ 67,
41
+ 216,
42
+ 3600,
43
+ 2721,
44
+ 3600,
45
+ 3600,
46
+ 2589,
47
+ 3600,
48
+ 86,
49
+ 3600,
50
+ 3600,
51
+ 635,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 262.4650030937046,
112
+ "mean_length": 2132.0,
113
+ "std_reward": 202.45606988720613,
114
+ "std_length": 1632.2904459684864,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 262.4650030937046,
117
+ "macro_mean_length": 2132.0,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_2000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 355.17000417932866,
7
+ "mean_length": 2880.0,
8
+ "std_reward": 150.5526274429939,
9
+ "std_length": 1212.814165484556,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 12.900000177323818,
14
+ 120.40000143647194,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 213.9000025317073,
20
+ 444.6000052243471,
21
+ 334.9000039473176,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 6.500000096857548,
30
+ 190.4000022560358
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 122,
36
+ 990,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 1745,
42
+ 3600,
43
+ 2721,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 67,
52
+ 1555
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 355.17000417932866,
112
+ "mean_length": 2880.0,
113
+ "std_reward": 150.5526274429939,
114
+ "std_length": 1212.814165484556,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 355.17000417932866,
117
+ "macro_mean_length": 2880.0,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_2250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 444.6000052243471,
7
+ "mean_length": 3600.0,
8
+ "std_reward": 0.0,
9
+ "std_length": 0.0,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 444.6000052243471,
112
+ "mean_length": 3600.0,
113
+ "std_reward": 0.0,
114
+ "std_length": 0.0,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 444.6000052243471,
117
+ "macro_mean_length": 3600.0,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 7.300000108778477,
7
+ "mean_length": 75.0,
8
+ "std_reward": 2.983789573085587,
9
+ "std_length": 25.0499500997507,
10
+ "episode_rewards": [
11
+ 6.100000090897083,
12
+ 18.400000244379044,
13
+ 5.000000089406967,
14
+ 6.100000090897083,
15
+ 9.200000137090683,
16
+ 6.200000092387199,
17
+ 6.000000089406967,
18
+ 6.200000092387199,
19
+ 6.400000095367432,
20
+ 11.000000149011612,
21
+ 6.100000090897083,
22
+ 6.400000095367432,
23
+ 5.000000089406967,
24
+ 6.100000090897083,
25
+ 5.000000089406967,
26
+ 6.200000092387199,
27
+ 9.100000135600567,
28
+ 6.400000095367432,
29
+ 6.000000089406967,
30
+ 9.100000135600567
31
+ ],
32
+ "episode_lengths": [
33
+ 63,
34
+ 168,
35
+ 61,
36
+ 63,
37
+ 94,
38
+ 64,
39
+ 62,
40
+ 64,
41
+ 66,
42
+ 103,
43
+ 63,
44
+ 66,
45
+ 61,
46
+ 63,
47
+ 61,
48
+ 64,
49
+ 93,
50
+ 66,
51
+ 62,
52
+ 93
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 7.300000108778477,
112
+ "mean_length": 75.0,
113
+ "std_reward": 2.983789573085587,
114
+ "std_length": 25.0499500997507,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 7.300000108778477,
117
+ "macro_mean_length": 75.0,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_2500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 407.0750047866255,
7
+ "mean_length": 3298.4,
8
+ "std_reward": 110.16133241065553,
9
+ "std_length": 886.7298010104319,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 424.80000500380993,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 121.20000144839287,
28
+ 444.6000052243471,
29
+ 37.300000466406345,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3449,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 998,
50
+ 3600,
51
+ 321,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 407.0750047866255,
112
+ "mean_length": 3298.4,
113
+ "std_reward": 110.16133241065553,
114
+ "std_length": 886.7298010104319,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 407.0750047866255,
117
+ "macro_mean_length": 3298.4,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_2750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 439.1150051604956,
7
+ "mean_length": 3556.05,
8
+ "std_reward": 23.90856098364273,
9
+ "std_length": 191.57360856861263,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 334.9000039473176,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 2721,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 439.1150051604956,
112
+ "mean_length": 3556.05,
113
+ "std_reward": 23.90856098364273,
114
+ "std_length": 191.57360856861263,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 439.1150051604956,
117
+ "macro_mean_length": 3556.05,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_3000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 429.16500504501164,
7
+ "mean_length": 3476.55,
8
+ "std_reward": 45.32389350974576,
9
+ "std_length": 363.78887764746185,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 438.60000516474247,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 293.6000034660101,
24
+ 444.6000052243471,
25
+ 292.9000034555793,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3560,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 2389,
46
+ 3600,
47
+ 2382,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 429.16500504501164,
112
+ "mean_length": 3476.55,
113
+ "std_reward": 45.32389350974576,
114
+ "std_length": 363.78887764746185,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 429.16500504501164,
117
+ "macro_mean_length": 3476.55,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_3250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 429.4350050482899,
7
+ "mean_length": 3478.9,
8
+ "std_reward": 39.604523877334316,
9
+ "std_length": 317.6977966558786,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 428.40000504255295,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 334.9000039473176,
22
+ 444.6000052243471,
23
+ 418.90000493079424,
24
+ 444.6000052243471,
25
+ 292.9000034555793,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3476,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 2721,
44
+ 3600,
45
+ 3399,
46
+ 3600,
47
+ 2382,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 429.4350050482899,
112
+ "mean_length": 3478.9,
113
+ "std_reward": 39.604523877334316,
114
+ "std_length": 317.6977966558786,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 429.4350050482899,
117
+ "macro_mean_length": 3478.9,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_3500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 390.0400045864284,
7
+ "mean_length": 3160.45,
8
+ "std_reward": 132.32670860218605,
9
+ "std_length": 1066.1402569549657,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 166.90000198036432,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 67.30000080913305,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 8.400000125169754,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 1365,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 558,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 86,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 390.0400045864284,
112
+ "mean_length": 3160.45,
113
+ "std_reward": 132.32670860218605,
114
+ "std_length": 1066.1402569549657,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 390.0400045864284,
117
+ "macro_mean_length": 3160.45,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_3750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 443.3150052096695,
7
+ "mean_length": 3589.95,
8
+ "std_reward": 5.601185206428131,
9
+ "std_length": 43.80693438258376,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 418.90000493079424,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3399,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 443.3150052096695,
112
+ "mean_length": 3589.95,
113
+ "std_reward": 5.601185206428131,
114
+ "std_length": 43.80693438258376,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 443.3150052096695,
117
+ "macro_mean_length": 3589.95,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_4000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 435.7300051212311,
7
+ "mean_length": 3529.05,
8
+ "std_reward": 33.241421837180205,
9
+ "std_length": 266.7627175974934,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 418.90000493079424,
24
+ 444.6000052243471,
25
+ 292.9000034555793,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3399,
46
+ 3600,
47
+ 2382,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 4000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 435.7300051212311,
112
+ "mean_length": 3529.05,
113
+ "std_reward": 33.241421837180205,
114
+ "std_length": 266.7627175974934,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 435.7300051212311,
117
+ "macro_mean_length": 3529.05,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 112.84000134691595,
7
+ "mean_length": 928.35,
8
+ "std_reward": 89.03625994868995,
9
+ "std_length": 718.7208968020898,
10
+ "episode_rewards": [
11
+ 8.400000125169754,
12
+ 176.40000209212303,
13
+ 12.900000177323818,
14
+ 129.90000154823065,
15
+ 162.40000192821026,
16
+ 250.90000296384096,
17
+ 344.4000040590763,
18
+ 45.90000056475401,
19
+ 73.90000089257956,
20
+ 185.90000220388174,
21
+ 54.90000066906214,
22
+ 40.900000505149364,
23
+ 113.50000134855509,
24
+ 137.00000162422657,
25
+ 22.400000289082527,
26
+ 53.00000064074993,
27
+ 120.40000143647194,
28
+ 64.40000078082085,
29
+ 22.400000289082527,
30
+ 236.9000027999282
31
+ ],
32
+ "episode_lengths": [
33
+ 86,
34
+ 1442,
35
+ 122,
36
+ 1067,
37
+ 1329,
38
+ 2043,
39
+ 2798,
40
+ 389,
41
+ 615,
42
+ 1519,
43
+ 461,
44
+ 348,
45
+ 930,
46
+ 1120,
47
+ 199,
48
+ 442,
49
+ 990,
50
+ 538,
51
+ 199,
52
+ 1930
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 112.84000134691595,
112
+ "mean_length": 928.35,
113
+ "std_reward": 89.03625994868995,
114
+ "std_length": 718.7208968020898,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 112.84000134691595,
117
+ "macro_mean_length": 928.35,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/mid_train/step_750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 63.71500077135861,
7
+ "mean_length": 531.6,
8
+ "std_reward": 44.58669444746131,
9
+ "std_length": 361.24041855805666,
10
+ "episode_rewards": [
11
+ 59.90000072866678,
12
+ 68.90000083297491,
13
+ 40.900000505149364,
14
+ 129.90000154823065,
15
+ 106.40000127255917,
16
+ 110.90000132471323,
17
+ 82.90000099688768,
18
+ 68.90000083297491,
19
+ 6.000000089406967,
20
+ 10.500000141561031,
21
+ 36.4000004529953,
22
+ 6.000000089406967,
23
+ 45.90000056475401,
24
+ 157.9000018760562,
25
+ 31.900000400841236,
26
+ 130.8000015616417,
27
+ 82.90000099688768,
28
+ 6.000000089406967,
29
+ 68.90000083297491,
30
+ 22.400000289082527
31
+ ],
32
+ "episode_lengths": [
33
+ 502,
34
+ 574,
35
+ 348,
36
+ 1067,
37
+ 877,
38
+ 913,
39
+ 687,
40
+ 574,
41
+ 62,
42
+ 98,
43
+ 312,
44
+ 62,
45
+ 389,
46
+ 1293,
47
+ 276,
48
+ 1076,
49
+ 687,
50
+ 62,
51
+ 574,
52
+ 199
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 63.71500077135861,
112
+ "mean_length": 531.6,
113
+ "std_reward": 44.58669444746131,
114
+ "std_length": 361.24041855805666,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 63.71500077135861,
117
+ "macro_mean_length": 531.6,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/eval/post_train/step_4000.json ADDED
@@ -0,0 +1,240 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 50,
6
+ "mean_reward": 422.26400496393444,
7
+ "mean_length": 3420.62,
8
+ "std_reward": 75.77649528754996,
9
+ "std_length": 609.5409056002723,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 418.90000493079424,
24
+ 444.6000052243471,
25
+ 292.9000034555793,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471,
31
+ 444.6000052243471,
32
+ 444.6000052243471,
33
+ 444.6000052243471,
34
+ 444.6000052243471,
35
+ 444.6000052243471,
36
+ 444.6000052243471,
37
+ 444.6000052243471,
38
+ 444.6000052243471,
39
+ 444.6000052243471,
40
+ 444.6000052243471,
41
+ 444.6000052243471,
42
+ 444.6000052243471,
43
+ 444.6000052243471,
44
+ 444.6000052243471,
45
+ 444.6000052243471,
46
+ 444.6000052243471,
47
+ 444.6000052243471,
48
+ 292.9000034555793,
49
+ 444.6000052243471,
50
+ 32.700000412762165,
51
+ 444.6000052243471,
52
+ 444.6000052243471,
53
+ 444.6000052243471,
54
+ 444.6000052243471,
55
+ 368.7000043466687,
56
+ 144.70000172406435,
57
+ 444.6000052243471,
58
+ 444.6000052243471,
59
+ 444.6000052243471,
60
+ 444.6000052243471
61
+ ],
62
+ "episode_lengths": [
63
+ 3600,
64
+ 3600,
65
+ 3600,
66
+ 3600,
67
+ 3600,
68
+ 3600,
69
+ 3600,
70
+ 3600,
71
+ 3600,
72
+ 3600,
73
+ 3600,
74
+ 3600,
75
+ 3399,
76
+ 3600,
77
+ 2382,
78
+ 3600,
79
+ 3600,
80
+ 3600,
81
+ 3600,
82
+ 3600,
83
+ 3600,
84
+ 3600,
85
+ 3600,
86
+ 3600,
87
+ 3600,
88
+ 3600,
89
+ 3600,
90
+ 3600,
91
+ 3600,
92
+ 3600,
93
+ 3600,
94
+ 3600,
95
+ 3600,
96
+ 3600,
97
+ 3600,
98
+ 3600,
99
+ 3600,
100
+ 2382,
101
+ 3600,
102
+ 284,
103
+ 3600,
104
+ 3600,
105
+ 3600,
106
+ 3600,
107
+ 2996,
108
+ 1188,
109
+ 3600,
110
+ 3600,
111
+ 3600,
112
+ 3600
113
+ ],
114
+ "decoded_action_hist": {},
115
+ "fixed_episode_seeds": true,
116
+ "eval_seed": 42,
117
+ "episode_seeds": [
118
+ null,
119
+ null,
120
+ null,
121
+ null,
122
+ null,
123
+ null,
124
+ null,
125
+ null,
126
+ null,
127
+ null,
128
+ null,
129
+ null,
130
+ null,
131
+ null,
132
+ null,
133
+ null,
134
+ null,
135
+ null,
136
+ null,
137
+ null,
138
+ null,
139
+ null,
140
+ null,
141
+ null,
142
+ null,
143
+ null,
144
+ null,
145
+ null,
146
+ null,
147
+ null,
148
+ null,
149
+ null,
150
+ null,
151
+ null,
152
+ null,
153
+ null,
154
+ null,
155
+ null,
156
+ null,
157
+ null,
158
+ null,
159
+ null,
160
+ null,
161
+ null,
162
+ null,
163
+ null,
164
+ null,
165
+ null,
166
+ null,
167
+ null
168
+ ],
169
+ "episode_indices": [
170
+ 0,
171
+ 1,
172
+ 2,
173
+ 3,
174
+ 4,
175
+ 5,
176
+ 6,
177
+ 7,
178
+ 8,
179
+ 9,
180
+ 10,
181
+ 11,
182
+ 12,
183
+ 13,
184
+ 14,
185
+ 15,
186
+ 16,
187
+ 17,
188
+ 18,
189
+ 19,
190
+ 20,
191
+ 21,
192
+ 22,
193
+ 23,
194
+ 24,
195
+ 25,
196
+ 26,
197
+ 27,
198
+ 28,
199
+ 29,
200
+ 30,
201
+ 31,
202
+ 32,
203
+ 33,
204
+ 34,
205
+ 35,
206
+ 36,
207
+ 37,
208
+ 38,
209
+ 39,
210
+ 40,
211
+ 41,
212
+ 42,
213
+ 43,
214
+ 44,
215
+ 45,
216
+ 46,
217
+ 47,
218
+ 48,
219
+ 49
220
+ ]
221
+ }
222
+ },
223
+ "aggregate": {
224
+ "stage": "post_train",
225
+ "step": 4000,
226
+ "task": "flappy",
227
+ "model_alias": "openvla",
228
+ "fixed_episode_seeds": true,
229
+ "eval_seed": 42,
230
+ "total_episodes": 50,
231
+ "mean_reward": 422.26400496393444,
232
+ "mean_length": 3420.62,
233
+ "std_reward": 75.77649528754996,
234
+ "std_length": 609.5409056002723,
235
+ "task_count": 1,
236
+ "macro_mean_reward": 422.26400496393444,
237
+ "macro_mean_length": 3420.62,
238
+ "distributed_eval": true
239
+ }
240
+ }
flappy_fix_latency_2_200ep_7k2steps_single_baseline/hydra/.hydra/config.yaml ADDED
@@ -0,0 +1,247 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ framework:
2
+ qwenvl:
3
+ base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
4
+ attn_implementation: flash_attention_2
5
+ flex_backend: triton
6
+ enable_gradient_checkpointing: true
7
+ action_model:
8
+ state_dim: 7
9
+ loss_type: discrete_ce
10
+ action_horizon: 1
11
+ future_action_window_size: 0
12
+ past_action_window_size: 0
13
+ action_dim: 7
14
+ action_env_dim: 2
15
+ kv_memory:
16
+ enabled: false
17
+ window: 4
18
+ rollout_len: 8
19
+ packed_train: false
20
+ rebased_sink: true
21
+ name: QwenOFT
22
+ datasets:
23
+ vla_data:
24
+ dataset_py: lerobot_datasets
25
+ include_state: true
26
+ data_root_dir: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
27
+ data_mix: flappy_train__bridge
28
+ eval_data_mix: flappy_train__bridge__val
29
+ custom_mixtures_path: null
30
+ action_type: discrete
31
+ sequential_step_sampling: false
32
+ eval_sequential_step_sampling: null
33
+ num_workers: 8
34
+ eval_num_workers: 8
35
+ prefetch_factor: 4
36
+ persistent_workers: true
37
+ pin_memory: true
38
+ shuffle: true
39
+ action_balance:
40
+ enabled: false
41
+ strategy: balanced_epoch
42
+ action_key: action_id
43
+ target_flap_fraction: 0.3
44
+ noop_id: 0
45
+ flap_id: 1
46
+ latency_curriculum:
47
+ enabled: false
48
+ strategy: exclusive
49
+ latencies: null
50
+ phase_steps: null
51
+ phase_distributions: null
52
+ new_latency_passes: 1.0
53
+ replay_passes: 0.25
54
+ target_total_passes: 2.0
55
+ final_equalization: true
56
+ step_budget_mode: auto
57
+ eval_at_phase_end: false
58
+ save_at_phase_end: false
59
+ computed_plan: null
60
+ per_device_batch_size: 32
61
+ load_all_data_for_training: true
62
+ num_obs_frames: 1
63
+ image_mode: single
64
+ prompt_mode: raw
65
+ stitch_grid:
66
+ - 2
67
+ - 2
68
+ obs_image_size: null
69
+ video_backend: torchvision_av
70
+ dataset:
71
+ source_hf: ''
72
+ config_name: null
73
+ source_subdir: null
74
+ converted_name: flappy_train
75
+ single_source_hf: ''
76
+ mixed_source_hf: ''
77
+ single_converted_name: flappy_train
78
+ mixed_converted_name: flappy_mixed_latency_train
79
+ single_latency_filter: null
80
+ mixed_latency_filter: null
81
+ force_download: false
82
+ setup_force: false
83
+ skip_verification: false
84
+ verify_rows: 200
85
+ max_episodes: null
86
+ episodes_per_latency: null
87
+ latency_filter: null
88
+ debug_subset:
89
+ enabled: false
90
+ max_episodes: 5
91
+ suffix: debug
92
+ base_model:
93
+ repo_id: Qwen/Qwen3-VL-4B-Instruct
94
+ initialization:
95
+ checkpoint_local_dir: playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
96
+ checkpoint_hf_repo_id: StarVLA/Qwen3VL-OFT-Bridge-RT-1
97
+ checkpoint_filename: checkpoints/steps_5000_pytorch_model.pt
98
+ trainer:
99
+ max_train_steps: 4000
100
+ num_warmup_steps: 100
101
+ save_interval: 500
102
+ eval_interval: 250
103
+ eval_num_batches: 50
104
+ per_latency_eval_num_batches: null
105
+ eval_action_classification: false
106
+ eval_action_classification_interval: null
107
+ cc_f1_tolerance: 1
108
+ learning_rate:
109
+ base: 2.0e-05
110
+ qwen_vl_interface: 1.0e-05
111
+ action_model: 0.0001
112
+ lr_scheduler_type: cosine_with_min_lr
113
+ scheduler_specific_kwargs:
114
+ min_lr: 1.0e-06
115
+ freeze_modules: ''
116
+ freeze_vit: false
117
+ freeze_tied_embedding: false
118
+ freeze_llm_layers: []
119
+ loss_scale:
120
+ vla: 1.0
121
+ vlm: 0.1
122
+ max_grad_norm: 1.0
123
+ weight_decay: 0.0
124
+ logging_frequency: 1
125
+ profile_timing:
126
+ enabled: false
127
+ log_interval: 10
128
+ gradient_clipping: 1.0
129
+ gradient_accumulation_steps: 2
130
+ distributed_backend: deepspeed
131
+ is_resume: false
132
+ pretrained_checkpoint: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
133
+ resume_step: 0
134
+ reload_modules: null
135
+ optimizer:
136
+ name: AdamW
137
+ betas:
138
+ - 0.9
139
+ - 0.95
140
+ eps: 1.0e-08
141
+ weight_decay: 1.0e-08
142
+ fused: true
143
+ save_format: pt
144
+ workspace_dir: WORKSPACE_DIR
145
+ run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
146
+ seed: 42
147
+ wandb_entity: saberrr-zju
148
+ wandb_project: starVLA_rl_games
149
+ auth:
150
+ env_file: null
151
+ hf_token_env: HF_TOKEN
152
+ wandb_api_key_env: WANDB_API_KEY
153
+ paths:
154
+ run_root_dir: results/Checkpoints
155
+ dataset_local_dir: data/flappy_fix_latency_2_200ep_7k2steps
156
+ dataset_cache_dir: null
157
+ base_model_dir: playground/Pretrained_models/Qwen3-VL-4B-Instruct
158
+ accelerate_config: starVLA/config/deepseeds/deepspeed_zero2.yaml
159
+ launch:
160
+ use_accelerate: true
161
+ gpus: null
162
+ num_processes: 1
163
+ dry_run: false
164
+ conda:
165
+ enabled: true
166
+ env_name: null
167
+ rl_games:
168
+ model_alias: openvla
169
+ env_eval:
170
+ image_size: 224
171
+ frameskip: 1
172
+ image_transform: raw_rgb
173
+ prompt_mode: raw
174
+ ghost_trail:
175
+ history_frames: 5
176
+ gamma: 1.3
177
+ min_alpha: 35
178
+ scroll_px_per_step: 4.0
179
+ ground_fraction: 0.22
180
+ seed: 42
181
+ fixed_episode_seeds: true
182
+ latency_seed_stride: 0
183
+ task_seed_stride: 0
184
+ task_description: ''
185
+ eval_parallel_envs: 5
186
+ enabled: true
187
+ eval_backend: latency_bench
188
+ distributed_mode: rank_sharded
189
+ vectorized:
190
+ enabled: false
191
+ batch_size: 1
192
+ latency:
193
+ prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
194
+ mode: single
195
+ values:
196
+ - 0
197
+ mid_train:
198
+ enabled: true
199
+ interval_steps: 250
200
+ latencies:
201
+ - 2
202
+ num_episodes: 20
203
+ max_steps_per_episode: 3600
204
+ post_train:
205
+ enabled: true
206
+ latencies:
207
+ - 2
208
+ num_episodes: 50
209
+ max_steps_per_episode: 3600
210
+ task: flappy
211
+ initialization_mode: bridge
212
+ action_carrier: bridge
213
+ model: openvla
214
+ env: flappy
215
+ init: bridge
216
+ bridge_base_model:
217
+ repo_id:
218
+ openvla: Qwen/Qwen3-VL-4B-Instruct
219
+ pi0: StarVLA/Qwen2.5-VL-3B-Instruct-Action
220
+ pi05: Qwen/Qwen3-VL-4B-Instruct
221
+ gr00t: Qwen/Qwen3-VL-4B-Instruct
222
+ local_dir:
223
+ openvla: playground/Pretrained_models/Qwen3-VL-4B-Instruct
224
+ pi0: playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
225
+ pi05: playground/Pretrained_models/Qwen3-VL-4B-Instruct
226
+ gr00t: playground/Pretrained_models/Qwen3-VL-4B-Instruct
227
+ mode: single
228
+ checkpoint:
229
+ load: none
230
+ hf_repo_id: null
231
+ save_best_model: false
232
+ save_final_model: true
233
+ save_pt_file: false
234
+ save_safetensors_file: true
235
+ local:
236
+ keep_last_n: 1
237
+ sync:
238
+ enabled: false
239
+ repo_id: null
240
+ keep_last_n: 0
241
+ sync_every_n_checkpoints: 1
242
+ resume_policy: local_latest
243
+ run_id: flappy_fix_latency_2_200ep_7k2steps_single_baseline
244
+ output_dir: null
245
+ config_yaml: null
246
+ is_debug: false
247
+ version_id: 0.21
flappy_fix_latency_2_200ep_7k2steps_single_baseline/hydra/.hydra/hydra.yaml ADDED
@@ -0,0 +1,368 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ hydra:
2
+ run:
3
+ dir: ${run_root_dir}/${run_id}/hydra
4
+ sweep:
5
+ dir: multirun/${now:%Y-%m-%d}/${now:%H-%M-%S}
6
+ subdir: ${hydra.job.num}
7
+ launcher:
8
+ _target_: hydra._internal.core_plugins.basic_launcher.BasicLauncher
9
+ sweeper:
10
+ _target_: hydra._internal.core_plugins.basic_sweeper.BasicSweeper
11
+ max_batch_size: null
12
+ params: null
13
+ help:
14
+ app_name: ${hydra.job.name}
15
+ header: '${hydra.help.app_name} is powered by Hydra.
16
+
17
+ '
18
+ footer: 'Powered by Hydra (https://hydra.cc)
19
+
20
+ Use --hydra-help to view Hydra specific help
21
+
22
+ '
23
+ template: '${hydra.help.header}
24
+
25
+ == Configuration groups ==
26
+
27
+ Compose your configuration from those groups (group=option)
28
+
29
+
30
+ $APP_CONFIG_GROUPS
31
+
32
+
33
+ == Config ==
34
+
35
+ Override anything in the config (foo.bar=value)
36
+
37
+
38
+ $CONFIG
39
+
40
+
41
+ ${hydra.help.footer}
42
+
43
+ '
44
+ hydra_help:
45
+ template: 'Hydra (${hydra.runtime.version})
46
+
47
+ See https://hydra.cc for more info.
48
+
49
+
50
+ == Flags ==
51
+
52
+ $FLAGS_HELP
53
+
54
+
55
+ == Configuration groups ==
56
+
57
+ Compose your configuration from those groups (For example, append hydra/job_logging=disabled
58
+ to command line)
59
+
60
+
61
+ $HYDRA_CONFIG_GROUPS
62
+
63
+
64
+ Use ''--cfg hydra'' to Show the Hydra config.
65
+
66
+ '
67
+ hydra_help: ???
68
+ hydra_logging:
69
+ version: 1
70
+ formatters:
71
+ simple:
72
+ format: '[%(asctime)s][HYDRA] %(message)s'
73
+ handlers:
74
+ console:
75
+ class: logging.StreamHandler
76
+ formatter: simple
77
+ stream: ext://sys.stdout
78
+ root:
79
+ level: INFO
80
+ handlers:
81
+ - console
82
+ loggers:
83
+ logging_example:
84
+ level: DEBUG
85
+ disable_existing_loggers: false
86
+ job_logging:
87
+ version: 1
88
+ formatters:
89
+ simple:
90
+ format: '[%(asctime)s][%(name)s][%(levelname)s] - %(message)s'
91
+ handlers:
92
+ console:
93
+ class: logging.StreamHandler
94
+ formatter: simple
95
+ stream: ext://sys.stdout
96
+ file:
97
+ class: logging.FileHandler
98
+ formatter: simple
99
+ filename: ${hydra.runtime.output_dir}/${hydra.job.name}.log
100
+ root:
101
+ level: INFO
102
+ handlers:
103
+ - console
104
+ - file
105
+ disable_existing_loggers: false
106
+ env: {}
107
+ mode: RUN
108
+ searchpath: []
109
+ callbacks: {}
110
+ output_subdir: .hydra
111
+ overrides:
112
+ hydra:
113
+ - hydra.mode=RUN
114
+ task:
115
+ - model=openvla
116
+ - env=flappy
117
+ - init=bridge
118
+ - mode=single
119
+ - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
120
+ - ++framework.qwenvl.attn_implementation=flash_attention_2
121
+ - ++framework.qwenvl.flex_backend=triton
122
+ - ++framework.qwenvl.enable_gradient_checkpointing=true
123
+ - ++framework.action_model.state_dim=7
124
+ - ++framework.action_model.loss_type=discrete_ce
125
+ - ++framework.action_model.action_horizon=1
126
+ - ++framework.action_model.future_action_window_size=0
127
+ - ++framework.action_model.past_action_window_size=0
128
+ - ++framework.action_model.action_dim=7
129
+ - ++framework.action_model.action_env_dim=2
130
+ - ++framework.kv_memory.enabled=false
131
+ - ++framework.kv_memory.window=4
132
+ - ++framework.kv_memory.rollout_len=8
133
+ - ++framework.kv_memory.packed_train=false
134
+ - ++framework.kv_memory.rebased_sink=true
135
+ - ++framework.name=QwenOFT
136
+ - ++datasets.vla_data.dataset_py=lerobot_datasets
137
+ - ++datasets.vla_data.include_state=true
138
+ - ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
139
+ - ++datasets.vla_data.data_mix=flappy_train
140
+ - ++datasets.vla_data.eval_data_mix=null
141
+ - ++datasets.vla_data.custom_mixtures_path=null
142
+ - ++datasets.vla_data.action_type=discrete
143
+ - ++datasets.vla_data.sequential_step_sampling=false
144
+ - ++datasets.vla_data.eval_sequential_step_sampling=null
145
+ - ++datasets.vla_data.num_workers=8
146
+ - ++datasets.vla_data.eval_num_workers=8
147
+ - ++datasets.vla_data.prefetch_factor=4
148
+ - ++datasets.vla_data.persistent_workers=true
149
+ - ++datasets.vla_data.pin_memory=true
150
+ - ++datasets.vla_data.shuffle=true
151
+ - ++datasets.vla_data.action_balance.enabled=false
152
+ - ++datasets.vla_data.action_balance.strategy=balanced_epoch
153
+ - ++datasets.vla_data.action_balance.action_key=action_id
154
+ - ++datasets.vla_data.action_balance.target_flap_fraction=0.3
155
+ - ++datasets.vla_data.action_balance.noop_id=0
156
+ - ++datasets.vla_data.action_balance.flap_id=1
157
+ - ++datasets.vla_data.latency_curriculum.enabled=false
158
+ - ++datasets.vla_data.latency_curriculum.strategy=exclusive
159
+ - ++datasets.vla_data.latency_curriculum.latencies=null
160
+ - ++datasets.vla_data.latency_curriculum.phase_steps=null
161
+ - ++datasets.vla_data.latency_curriculum.phase_distributions=null
162
+ - ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
163
+ - ++datasets.vla_data.latency_curriculum.replay_passes=0.25
164
+ - ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
165
+ - ++datasets.vla_data.latency_curriculum.final_equalization=true
166
+ - ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
167
+ - ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
168
+ - ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
169
+ - ++datasets.vla_data.latency_curriculum.computed_plan=null
170
+ - ++datasets.vla_data.per_device_batch_size=32
171
+ - ++datasets.vla_data.load_all_data_for_training=true
172
+ - ++datasets.vla_data.num_obs_frames=1
173
+ - ++datasets.vla_data.image_mode=single
174
+ - ++datasets.vla_data.prompt_mode=raw
175
+ - ++datasets.vla_data.stitch_grid=[2,2]
176
+ - ++datasets.vla_data.obs_image_size=null
177
+ - ++datasets.vla_data.video_backend=torchvision_av
178
+ - ++dataset.source_hf=
179
+ - ++dataset.config_name=null
180
+ - ++dataset.source_subdir=null
181
+ - ++dataset.converted_name=flappy_train
182
+ - ++dataset.single_source_hf=
183
+ - ++dataset.mixed_source_hf=
184
+ - ++dataset.single_converted_name=flappy_train
185
+ - ++dataset.mixed_converted_name=flappy_mixed_latency_train
186
+ - ++dataset.single_latency_filter=null
187
+ - ++dataset.mixed_latency_filter=null
188
+ - ++dataset.force_download=false
189
+ - ++dataset.setup_force=false
190
+ - ++dataset.skip_verification=false
191
+ - ++dataset.verify_rows=200
192
+ - ++dataset.max_episodes=null
193
+ - ++dataset.episodes_per_latency=null
194
+ - ++dataset.latency_filter=null
195
+ - ++dataset.debug_subset.enabled=false
196
+ - ++dataset.debug_subset.max_episodes=5
197
+ - ++dataset.debug_subset.suffix=debug
198
+ - ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
199
+ - ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
200
+ - ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
201
+ - ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
202
+ - trainer.max_train_steps=4000
203
+ - trainer.num_warmup_steps=100
204
+ - trainer.save_interval=500
205
+ - trainer.eval_interval=250
206
+ - trainer.eval_num_batches=50
207
+ - trainer.per_latency_eval_num_batches=null
208
+ - trainer.eval_action_classification=false
209
+ - trainer.eval_action_classification_interval=null
210
+ - trainer.cc_f1_tolerance=1
211
+ - trainer.learning_rate.base=2e-05
212
+ - trainer.learning_rate.qwen_vl_interface=1e-05
213
+ - trainer.learning_rate.action_model=0.0001
214
+ - trainer.lr_scheduler_type=cosine_with_min_lr
215
+ - trainer.scheduler_specific_kwargs.min_lr=1e-06
216
+ - trainer.freeze_modules=
217
+ - trainer.freeze_vit=false
218
+ - trainer.freeze_tied_embedding=false
219
+ - trainer.freeze_llm_layers=[]
220
+ - trainer.loss_scale.vla=1.0
221
+ - trainer.loss_scale.vlm=0.1
222
+ - trainer.max_grad_norm=1.0
223
+ - trainer.weight_decay=0.0
224
+ - trainer.logging_frequency=1
225
+ - trainer.profile_timing.enabled=false
226
+ - trainer.profile_timing.log_interval=10
227
+ - trainer.gradient_clipping=1.0
228
+ - trainer.gradient_accumulation_steps=2
229
+ - trainer.distributed_backend=deepspeed
230
+ - trainer.is_resume=false
231
+ - trainer.pretrained_checkpoint=null
232
+ - trainer.resume_step=0
233
+ - trainer.reload_modules=null
234
+ - trainer.optimizer.name=AdamW
235
+ - trainer.optimizer.betas=[0.9,0.95]
236
+ - trainer.optimizer.eps=1e-08
237
+ - trainer.optimizer.weight_decay=1e-08
238
+ - trainer.optimizer.fused=true
239
+ - trainer.save_format=pt
240
+ - ++workspace_dir=WORKSPACE_DIR
241
+ - ++run_root_dir=results/Checkpoints
242
+ - ++seed=42
243
+ - ++wandb_entity=saberrr-zju
244
+ - ++wandb_project=starVLA_rl_games
245
+ - ++auth.env_file=null
246
+ - ++auth.hf_token_env=HF_TOKEN
247
+ - ++auth.wandb_api_key_env=WANDB_API_KEY
248
+ - ++paths.run_root_dir=results/Checkpoints
249
+ - ++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps
250
+ - ++paths.dataset_cache_dir=null
251
+ - ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
252
+ - ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
253
+ - ++rl_games.model_alias=openvla
254
+ - ++rl_games.env_eval.image_size=224
255
+ - ++rl_games.env_eval.frameskip=1
256
+ - ++rl_games.env_eval.image_transform=raw_rgb
257
+ - ++rl_games.env_eval.prompt_mode=raw
258
+ - ++rl_games.env_eval.ghost_trail.history_frames=5
259
+ - ++rl_games.env_eval.ghost_trail.gamma=1.3
260
+ - ++rl_games.env_eval.ghost_trail.min_alpha=35
261
+ - ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
262
+ - ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
263
+ - ++rl_games.env_eval.seed=42
264
+ - ++rl_games.env_eval.fixed_episode_seeds=true
265
+ - ++rl_games.env_eval.latency_seed_stride=0
266
+ - ++rl_games.env_eval.task_seed_stride=0
267
+ - ++rl_games.env_eval.task_description=
268
+ - ++rl_games.env_eval.eval_parallel_envs=5
269
+ - ++rl_games.env_eval.enabled=true
270
+ - ++rl_games.env_eval.eval_backend=latency_bench
271
+ - ++rl_games.env_eval.distributed_mode=rank_sharded
272
+ - ++rl_games.env_eval.vectorized.enabled=false
273
+ - ++rl_games.env_eval.vectorized.batch_size=1
274
+ - ++rl_games.env_eval.latency.prompt_map_path=null
275
+ - ++rl_games.env_eval.latency.mode=single
276
+ - ++rl_games.env_eval.latency.values=[0]
277
+ - ++rl_games.env_eval.mid_train.enabled=true
278
+ - ++rl_games.env_eval.mid_train.interval_steps=250
279
+ - ++rl_games.env_eval.mid_train.latencies=[2]
280
+ - ++rl_games.env_eval.mid_train.num_episodes=20
281
+ - ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
282
+ - ++rl_games.env_eval.post_train.enabled=true
283
+ - ++rl_games.env_eval.post_train.latencies=[2]
284
+ - ++rl_games.env_eval.post_train.num_episodes=50
285
+ - ++rl_games.env_eval.post_train.max_steps_per_episode=3600
286
+ - ++rl_games.task=flappy
287
+ - ++rl_games.initialization_mode=bridge
288
+ - ++rl_games.action_carrier=bridge
289
+ - ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
290
+ - ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
291
+ - ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
292
+ - ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
293
+ - ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
294
+ - ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
295
+ - ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
296
+ - ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
297
+ - ++checkpoint.load=none
298
+ - ++checkpoint.hf_repo_id=null
299
+ - ++checkpoint.save_best_model=false
300
+ - ++checkpoint.save_final_model=true
301
+ - ++checkpoint.save_pt_file=false
302
+ - ++checkpoint.save_safetensors_file=true
303
+ - ++checkpoint.local.keep_last_n=1
304
+ - ++checkpoint.sync.enabled=false
305
+ - ++checkpoint.sync.repo_id=null
306
+ - ++checkpoint.sync.keep_last_n=0
307
+ - ++checkpoint.sync.sync_every_n_checkpoints=1
308
+ - ++checkpoint.sync.resume_policy=local_latest
309
+ - ++run_id=flappy_fix_latency_2_200ep_7k2steps_single_baseline
310
+ - ++output_dir=null
311
+ - ++config_yaml=null
312
+ - ++is_debug=false
313
+ - ++version_id=0.21
314
+ - ++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints
315
+ - trainer.is_resume=false
316
+ - trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
317
+ - trainer.resume_step=0
318
+ - ++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
319
+ - ++datasets.vla_data.data_mix=flappy_train__bridge
320
+ - ++datasets.vla_data.eval_data_mix=flappy_train__bridge__val
321
+ - ++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
322
+ - ++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
323
+ job:
324
+ name: train_starvla_hydra
325
+ chdir: false
326
+ override_dirname: ++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=none,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=flappy_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=flappy_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=flappy_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=flappy_train,++datasets.vla_data.data_mix=flappy_train__bridge,++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=flappy_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=single,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=1,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=32,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=2,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++framework.qwenvl.flex_backend=triton,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=1,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=true,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=true,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description=,++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=flappy,++run_id=flappy_fix_latency_2_200ep_7k2steps_single_baseline,++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++version_id=0.21,++wandb_entity=saberrr-zju,++wandb_project=starVLA_rl_games,++workspace_dir=WORKSPACE_DIR,env=flappy,init=bridge,mode=single,model=openvla,trainer.cc_f1_tolerance=1,trainer.distributed_backend=deepspeed,trainer.eval_action_classification=false,trainer.eval_action_classification_interval=null,trainer.eval_interval=250,trainer.eval_num_batches=50,trainer.freeze_llm_layers=[],trainer.freeze_modules=,trainer.freeze_tied_embedding=false,trainer.freeze_vit=false,trainer.gradient_accumulation_steps=2,trainer.gradient_clipping=1.0,trainer.is_resume=false,trainer.is_resume=false,trainer.learning_rate.action_model=0.0001,trainer.learning_rate.base=2e-05,trainer.learning_rate.qwen_vl_interface=1e-05,trainer.logging_frequency=1,trainer.loss_scale.vla=1.0,trainer.loss_scale.vlm=0.1,trainer.lr_scheduler_type=cosine_with_min_lr,trainer.max_grad_norm=1.0,trainer.max_train_steps=4000,trainer.num_warmup_steps=100,trainer.optimizer.betas=[0.9,0.95],trainer.optimizer.eps=1e-08,trainer.optimizer.fused=true,trainer.optimizer.name=AdamW,trainer.optimizer.weight_decay=1e-08,trainer.per_latency_eval_num_batches=null,trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt,trainer.pretrained_checkpoint=null,trainer.profile_timing.enabled=false,trainer.profile_timing.log_interval=10,trainer.reload_modules=null,trainer.resume_step=0,trainer.resume_step=0,trainer.save_format=pt,trainer.save_interval=500,trainer.scheduler_specific_kwargs.min_lr=1e-06,trainer.weight_decay=0.0
327
+ id: ???
328
+ num: ???
329
+ config_name: train
330
+ env_set: {}
331
+ env_copy: []
332
+ config:
333
+ override_dirname:
334
+ kv_sep: '='
335
+ item_sep: ','
336
+ exclude_keys: []
337
+ runtime:
338
+ version: 1.3.3
339
+ version_base: '1.1'
340
+ cwd: /workspace/latency-sensitive-bench/starVLA
341
+ config_sources:
342
+ - path: hydra.conf
343
+ schema: pkg
344
+ provider: hydra
345
+ - path: /workspace/latency-sensitive-bench/starVLA/examples/rl_games/config
346
+ schema: file
347
+ provider: main
348
+ - path: ''
349
+ schema: structured
350
+ provider: schema
351
+ output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/hydra
352
+ choices:
353
+ cross_task_setup: null
354
+ checkpoint: default
355
+ mode: single
356
+ init: bridge
357
+ env: flappy
358
+ model: openvla
359
+ hydra/env: default
360
+ hydra/callbacks: null
361
+ hydra/job_logging: default
362
+ hydra/hydra_logging: default
363
+ hydra/hydra_help: default
364
+ hydra/help: default
365
+ hydra/sweeper: basic
366
+ hydra/launcher: basic
367
+ hydra/output: default
368
+ verbose: false
flappy_fix_latency_2_200ep_7k2steps_single_baseline/hydra/.hydra/overrides.yaml ADDED
@@ -0,0 +1,208 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ - model=openvla
2
+ - env=flappy
3
+ - init=bridge
4
+ - mode=single
5
+ - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
6
+ - ++framework.qwenvl.attn_implementation=flash_attention_2
7
+ - ++framework.qwenvl.flex_backend=triton
8
+ - ++framework.qwenvl.enable_gradient_checkpointing=true
9
+ - ++framework.action_model.state_dim=7
10
+ - ++framework.action_model.loss_type=discrete_ce
11
+ - ++framework.action_model.action_horizon=1
12
+ - ++framework.action_model.future_action_window_size=0
13
+ - ++framework.action_model.past_action_window_size=0
14
+ - ++framework.action_model.action_dim=7
15
+ - ++framework.action_model.action_env_dim=2
16
+ - ++framework.kv_memory.enabled=false
17
+ - ++framework.kv_memory.window=4
18
+ - ++framework.kv_memory.rollout_len=8
19
+ - ++framework.kv_memory.packed_train=false
20
+ - ++framework.kv_memory.rebased_sink=true
21
+ - ++framework.name=QwenOFT
22
+ - ++datasets.vla_data.dataset_py=lerobot_datasets
23
+ - ++datasets.vla_data.include_state=true
24
+ - ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
25
+ - ++datasets.vla_data.data_mix=flappy_train
26
+ - ++datasets.vla_data.eval_data_mix=null
27
+ - ++datasets.vla_data.custom_mixtures_path=null
28
+ - ++datasets.vla_data.action_type=discrete
29
+ - ++datasets.vla_data.sequential_step_sampling=false
30
+ - ++datasets.vla_data.eval_sequential_step_sampling=null
31
+ - ++datasets.vla_data.num_workers=8
32
+ - ++datasets.vla_data.eval_num_workers=8
33
+ - ++datasets.vla_data.prefetch_factor=4
34
+ - ++datasets.vla_data.persistent_workers=true
35
+ - ++datasets.vla_data.pin_memory=true
36
+ - ++datasets.vla_data.shuffle=true
37
+ - ++datasets.vla_data.action_balance.enabled=false
38
+ - ++datasets.vla_data.action_balance.strategy=balanced_epoch
39
+ - ++datasets.vla_data.action_balance.action_key=action_id
40
+ - ++datasets.vla_data.action_balance.target_flap_fraction=0.3
41
+ - ++datasets.vla_data.action_balance.noop_id=0
42
+ - ++datasets.vla_data.action_balance.flap_id=1
43
+ - ++datasets.vla_data.latency_curriculum.enabled=false
44
+ - ++datasets.vla_data.latency_curriculum.strategy=exclusive
45
+ - ++datasets.vla_data.latency_curriculum.latencies=null
46
+ - ++datasets.vla_data.latency_curriculum.phase_steps=null
47
+ - ++datasets.vla_data.latency_curriculum.phase_distributions=null
48
+ - ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
49
+ - ++datasets.vla_data.latency_curriculum.replay_passes=0.25
50
+ - ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
51
+ - ++datasets.vla_data.latency_curriculum.final_equalization=true
52
+ - ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
53
+ - ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
54
+ - ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
55
+ - ++datasets.vla_data.latency_curriculum.computed_plan=null
56
+ - ++datasets.vla_data.per_device_batch_size=32
57
+ - ++datasets.vla_data.load_all_data_for_training=true
58
+ - ++datasets.vla_data.num_obs_frames=1
59
+ - ++datasets.vla_data.image_mode=single
60
+ - ++datasets.vla_data.prompt_mode=raw
61
+ - ++datasets.vla_data.stitch_grid=[2,2]
62
+ - ++datasets.vla_data.obs_image_size=null
63
+ - ++datasets.vla_data.video_backend=torchvision_av
64
+ - ++dataset.source_hf=
65
+ - ++dataset.config_name=null
66
+ - ++dataset.source_subdir=null
67
+ - ++dataset.converted_name=flappy_train
68
+ - ++dataset.single_source_hf=
69
+ - ++dataset.mixed_source_hf=
70
+ - ++dataset.single_converted_name=flappy_train
71
+ - ++dataset.mixed_converted_name=flappy_mixed_latency_train
72
+ - ++dataset.single_latency_filter=null
73
+ - ++dataset.mixed_latency_filter=null
74
+ - ++dataset.force_download=false
75
+ - ++dataset.setup_force=false
76
+ - ++dataset.skip_verification=false
77
+ - ++dataset.verify_rows=200
78
+ - ++dataset.max_episodes=null
79
+ - ++dataset.episodes_per_latency=null
80
+ - ++dataset.latency_filter=null
81
+ - ++dataset.debug_subset.enabled=false
82
+ - ++dataset.debug_subset.max_episodes=5
83
+ - ++dataset.debug_subset.suffix=debug
84
+ - ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
85
+ - ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
86
+ - ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
87
+ - ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
88
+ - trainer.max_train_steps=4000
89
+ - trainer.num_warmup_steps=100
90
+ - trainer.save_interval=500
91
+ - trainer.eval_interval=250
92
+ - trainer.eval_num_batches=50
93
+ - trainer.per_latency_eval_num_batches=null
94
+ - trainer.eval_action_classification=false
95
+ - trainer.eval_action_classification_interval=null
96
+ - trainer.cc_f1_tolerance=1
97
+ - trainer.learning_rate.base=2e-05
98
+ - trainer.learning_rate.qwen_vl_interface=1e-05
99
+ - trainer.learning_rate.action_model=0.0001
100
+ - trainer.lr_scheduler_type=cosine_with_min_lr
101
+ - trainer.scheduler_specific_kwargs.min_lr=1e-06
102
+ - trainer.freeze_modules=
103
+ - trainer.freeze_vit=false
104
+ - trainer.freeze_tied_embedding=false
105
+ - trainer.freeze_llm_layers=[]
106
+ - trainer.loss_scale.vla=1.0
107
+ - trainer.loss_scale.vlm=0.1
108
+ - trainer.max_grad_norm=1.0
109
+ - trainer.weight_decay=0.0
110
+ - trainer.logging_frequency=1
111
+ - trainer.profile_timing.enabled=false
112
+ - trainer.profile_timing.log_interval=10
113
+ - trainer.gradient_clipping=1.0
114
+ - trainer.gradient_accumulation_steps=2
115
+ - trainer.distributed_backend=deepspeed
116
+ - trainer.is_resume=false
117
+ - trainer.pretrained_checkpoint=null
118
+ - trainer.resume_step=0
119
+ - trainer.reload_modules=null
120
+ - trainer.optimizer.name=AdamW
121
+ - trainer.optimizer.betas=[0.9,0.95]
122
+ - trainer.optimizer.eps=1e-08
123
+ - trainer.optimizer.weight_decay=1e-08
124
+ - trainer.optimizer.fused=true
125
+ - trainer.save_format=pt
126
+ - ++workspace_dir=WORKSPACE_DIR
127
+ - ++run_root_dir=results/Checkpoints
128
+ - ++seed=42
129
+ - ++wandb_entity=saberrr-zju
130
+ - ++wandb_project=starVLA_rl_games
131
+ - ++auth.env_file=null
132
+ - ++auth.hf_token_env=HF_TOKEN
133
+ - ++auth.wandb_api_key_env=WANDB_API_KEY
134
+ - ++paths.run_root_dir=results/Checkpoints
135
+ - ++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps
136
+ - ++paths.dataset_cache_dir=null
137
+ - ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
138
+ - ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
139
+ - ++rl_games.model_alias=openvla
140
+ - ++rl_games.env_eval.image_size=224
141
+ - ++rl_games.env_eval.frameskip=1
142
+ - ++rl_games.env_eval.image_transform=raw_rgb
143
+ - ++rl_games.env_eval.prompt_mode=raw
144
+ - ++rl_games.env_eval.ghost_trail.history_frames=5
145
+ - ++rl_games.env_eval.ghost_trail.gamma=1.3
146
+ - ++rl_games.env_eval.ghost_trail.min_alpha=35
147
+ - ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
148
+ - ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
149
+ - ++rl_games.env_eval.seed=42
150
+ - ++rl_games.env_eval.fixed_episode_seeds=true
151
+ - ++rl_games.env_eval.latency_seed_stride=0
152
+ - ++rl_games.env_eval.task_seed_stride=0
153
+ - ++rl_games.env_eval.task_description=
154
+ - ++rl_games.env_eval.eval_parallel_envs=5
155
+ - ++rl_games.env_eval.enabled=true
156
+ - ++rl_games.env_eval.eval_backend=latency_bench
157
+ - ++rl_games.env_eval.distributed_mode=rank_sharded
158
+ - ++rl_games.env_eval.vectorized.enabled=false
159
+ - ++rl_games.env_eval.vectorized.batch_size=1
160
+ - ++rl_games.env_eval.latency.prompt_map_path=null
161
+ - ++rl_games.env_eval.latency.mode=single
162
+ - ++rl_games.env_eval.latency.values=[0]
163
+ - ++rl_games.env_eval.mid_train.enabled=true
164
+ - ++rl_games.env_eval.mid_train.interval_steps=250
165
+ - ++rl_games.env_eval.mid_train.latencies=[2]
166
+ - ++rl_games.env_eval.mid_train.num_episodes=20
167
+ - ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
168
+ - ++rl_games.env_eval.post_train.enabled=true
169
+ - ++rl_games.env_eval.post_train.latencies=[2]
170
+ - ++rl_games.env_eval.post_train.num_episodes=50
171
+ - ++rl_games.env_eval.post_train.max_steps_per_episode=3600
172
+ - ++rl_games.task=flappy
173
+ - ++rl_games.initialization_mode=bridge
174
+ - ++rl_games.action_carrier=bridge
175
+ - ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
176
+ - ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
177
+ - ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
178
+ - ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
179
+ - ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
180
+ - ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
181
+ - ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
182
+ - ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
183
+ - ++checkpoint.load=none
184
+ - ++checkpoint.hf_repo_id=null
185
+ - ++checkpoint.save_best_model=false
186
+ - ++checkpoint.save_final_model=true
187
+ - ++checkpoint.save_pt_file=false
188
+ - ++checkpoint.save_safetensors_file=true
189
+ - ++checkpoint.local.keep_last_n=1
190
+ - ++checkpoint.sync.enabled=false
191
+ - ++checkpoint.sync.repo_id=null
192
+ - ++checkpoint.sync.keep_last_n=0
193
+ - ++checkpoint.sync.sync_every_n_checkpoints=1
194
+ - ++checkpoint.sync.resume_policy=local_latest
195
+ - ++run_id=flappy_fix_latency_2_200ep_7k2steps_single_baseline
196
+ - ++output_dir=null
197
+ - ++config_yaml=null
198
+ - ++is_debug=false
199
+ - ++version_id=0.21
200
+ - ++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints
201
+ - trainer.is_resume=false
202
+ - trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
203
+ - trainer.resume_step=0
204
+ - ++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
205
+ - ++datasets.vla_data.data_mix=flappy_train__bridge
206
+ - ++datasets.vla_data.eval_data_mix=flappy_train__bridge__val
207
+ - ++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
208
+ - ++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
flappy_fix_latency_2_200ep_7k2steps_single_baseline/hydra/train_starvla_hydra.log ADDED
The diff for this file is too large to render. See raw diff
 
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 1, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 3, "episode_return": 120.40000143647194, "episode_return_env": 120.40000143647194, "game_score": 25.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 990, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 990}
3
+ {"episode_id": 5, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 7, "episode_return": 87.90000105649233, "episode_return_env": 87.90000105649233, "game_score": 18.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 728, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 728}
5
+ {"episode_id": 9, "episode_return": 113.50000134855509, "episode_return_env": 113.50000134855509, "game_score": 24.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 930, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 930}
6
+ {"episode_id": 11, "episode_return": 101.9000012204051, "episode_return_env": 101.9000012204051, "game_score": 21.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 841, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 841}
7
+ {"episode_id": 13, "episode_return": 269.9000031873584, "episode_return_env": 269.9000031873584, "game_score": 57.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2197, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2197}
8
+ {"episode_id": 15, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 17, "episode_return": 409.9000048264861, "episode_return_env": 409.9000048264861, "game_score": 87.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3327, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3327}
10
+ {"episode_id": 19, "episode_return": 255.9000030234456, "episode_return_env": 255.9000030234456, "game_score": 54.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2084, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2084}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 8, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
6
+ {"episode_id": 10, "episode_return": 102.90000123530626, "episode_return_env": 102.90000123530626, "game_score": 21.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 851, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 851}
7
+ {"episode_id": 12, "episode_return": 295.60000348091125, "episode_return_env": 295.60000348091125, "game_score": 63.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2400, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2400}
8
+ {"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 16, "episode_return": 51.400000631809235, "episode_return_env": 51.400000631809235, "game_score": 10.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 435, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 435}
10
+ {"episode_id": 18, "episode_return": 429.4000050574541, "episode_return_env": 429.4000050574541, "game_score": 91.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3486, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3486}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 8, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
6
+ {"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
7
+ {"episode_id": 12, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
8
+ {"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 16, "episode_return": 274.40000323951244, "episode_return_env": 274.40000323951244, "game_score": 58.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2233, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2233}
10
+ {"episode_id": 18, "episode_return": 11.30000015348196, "episode_return_env": 11.30000015348196, "game_score": 2.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 106, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 106}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 1, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 3, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 5, "episode_return": 8.400000125169754, "episode_return_env": 8.400000125169754, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 86, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 86}
4
+ {"episode_id": 7, "episode_return": 6.500000096857548, "episode_return_env": 6.500000096857548, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 67, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 67}
5
+ {"episode_id": 9, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
6
+ {"episode_id": 11, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
7
+ {"episode_id": 13, "episode_return": 319.0000037550926, "episode_return_env": 319.0000037550926, "game_score": 68.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2589, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2589}
8
+ {"episode_id": 15, "episode_return": 8.400000125169754, "episode_return_env": 8.400000125169754, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 86, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 86}
9
+ {"episode_id": 17, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 19, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 1, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 3, "episode_return": 120.40000143647194, "episode_return_env": 120.40000143647194, "game_score": 25.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 990, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 990}
3
+ {"episode_id": 5, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 7, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 9, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
6
+ {"episode_id": 11, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
7
+ {"episode_id": 13, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
8
+ {"episode_id": 15, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 17, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 19, "episode_return": 190.4000022560358, "episode_return_env": 190.4000022560358, "game_score": 40.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1555, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1555}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 8, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
6
+ {"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
7
+ {"episode_id": 12, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
8
+ {"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 18, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 1, "episode_return": 18.400000244379044, "episode_return_env": 18.400000244379044, "game_score": 3.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 168, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 168}
2
+ {"episode_id": 3, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
3
+ {"episode_id": 5, "episode_return": 6.200000092387199, "episode_return_env": 6.200000092387199, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 64, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 64}
4
+ {"episode_id": 7, "episode_return": 6.200000092387199, "episode_return_env": 6.200000092387199, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 64, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 64}
5
+ {"episode_id": 9, "episode_return": 11.000000149011612, "episode_return_env": 11.000000149011612, "game_score": 2.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 103, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 103}
6
+ {"episode_id": 11, "episode_return": 6.400000095367432, "episode_return_env": 6.400000095367432, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 66, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 66}
7
+ {"episode_id": 13, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
8
+ {"episode_id": 15, "episode_return": 6.200000092387199, "episode_return_env": 6.200000092387199, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 64, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 64}
9
+ {"episode_id": 17, "episode_return": 6.400000095367432, "episode_return_env": 6.400000095367432, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 66, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 66}
10
+ {"episode_id": 19, "episode_return": 9.100000135600567, "episode_return_env": 9.100000135600567, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 93, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 93}
flappy_fix_latency_2_200ep_7k2steps_single_baseline/latency_bench_eval/mid_train/step_2500/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}