Upload folder using huggingface_hub
Browse filesThis view is limited to 50 files because it contains too many changes. See raw diff
- .gitattributes +2 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt +3 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/steps_4000_model.safetensors +3 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/config.full.yaml +249 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/config.yaml +102 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/dataset_statistics.json +127 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/dataset_statistics_eval.json +127 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1000.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1250.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1500.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1750.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2000.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2250.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_250.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2500.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2750.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3000.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3250.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3500.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3750.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_4000.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_500.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_750.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/eval/post_train/step_4000.json +240 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/config.yaml +247 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/hydra.yaml +368 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/overrides.yaml +208 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/train_starvla_hydra.log +0 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2500/_progress/rank_0.json +1 -0
.gitattributes
CHANGED
|
@@ -36,3 +36,5 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
|
| 36 |
flappy_fix_latency_2_200ep_7k2steps_kv_memory_flex/wandb/wandb/run-20260628_174516-d5o0ia06/run-d5o0ia06.wandb filter=lfs diff=lfs merge=lfs -text
|
| 37 |
flappy_fix_latency_2_200ep_7k2steps_single_baseline/wandb/wandb/run-20260629_061046-mj819fop/run-mj819fop.wandb filter=lfs diff=lfs merge=lfs -text
|
| 38 |
flappy_fix_latency_2_200ep_7k2steps_plain_multi/wandb/wandb/run-20260629_115519-lyl43qp2/run-lyl43qp2.wandb filter=lfs diff=lfs merge=lfs -text
|
|
|
|
|
|
|
|
|
| 36 |
flappy_fix_latency_2_200ep_7k2steps_kv_memory_flex/wandb/wandb/run-20260628_174516-d5o0ia06/run-d5o0ia06.wandb filter=lfs diff=lfs merge=lfs -text
|
| 37 |
flappy_fix_latency_2_200ep_7k2steps_single_baseline/wandb/wandb/run-20260629_061046-mj819fop/run-mj819fop.wandb filter=lfs diff=lfs merge=lfs -text
|
| 38 |
flappy_fix_latency_2_200ep_7k2steps_plain_multi/wandb/wandb/run-20260629_115519-lyl43qp2/run-lyl43qp2.wandb filter=lfs diff=lfs merge=lfs -text
|
| 39 |
+
flappy_fix_latency_2_200ep_7k2steps_stitch/wandb/wandb/run-20260630_041200-hmyjkpa8/run-hmyjkpa8.wandb filter=lfs diff=lfs merge=lfs -text
|
| 40 |
+
flappy_fix_latency_2_200ep_7k2steps_stitch/wandb/wandb/run-20260630_041925-z7qwgx6l/run-z7qwgx6l.wandb filter=lfs diff=lfs merge=lfs -text
|
flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:371cb744227687bb99bcad7f9ff2250cf06da75631359ad3eba4c6bc52570607
|
| 3 |
+
size 9785060316
|
flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/steps_4000_model.safetensors
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:d29f05e6565500aecc785f04b687b107f703021b59947f2d261d167fb932c3f5
|
| 3 |
+
size 9784896838
|
flappy_fix_latency_2_200ep_7k2steps_stitch/config.full.yaml
ADDED
|
@@ -0,0 +1,249 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
framework:
|
| 2 |
+
name: QwenOFT
|
| 3 |
+
qwenvl:
|
| 4 |
+
base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 5 |
+
attn_implementation: flash_attention_2
|
| 6 |
+
flex_backend: triton
|
| 7 |
+
enable_gradient_checkpointing: true
|
| 8 |
+
action_model:
|
| 9 |
+
action_model_type: MLP
|
| 10 |
+
action_dim: 7
|
| 11 |
+
action_hidden_dim: 2560
|
| 12 |
+
future_action_window_size: 0
|
| 13 |
+
past_action_window_size: 0
|
| 14 |
+
loss_type: discrete_ce
|
| 15 |
+
state_dim: 7
|
| 16 |
+
action_horizon: 1
|
| 17 |
+
action_env_dim: 2
|
| 18 |
+
kv_memory:
|
| 19 |
+
enabled: false
|
| 20 |
+
window: 4
|
| 21 |
+
rollout_len: 8
|
| 22 |
+
packed_train: false
|
| 23 |
+
rebased_sink: true
|
| 24 |
+
datasets:
|
| 25 |
+
vla_data:
|
| 26 |
+
dataset_py: lerobot_datasets
|
| 27 |
+
include_state: true
|
| 28 |
+
data_root_dir: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
|
| 29 |
+
data_mix: flappy_train__bridge
|
| 30 |
+
eval_data_mix: flappy_train__bridge__val
|
| 31 |
+
custom_mixtures_path: null
|
| 32 |
+
action_type: discrete
|
| 33 |
+
sequential_step_sampling: false
|
| 34 |
+
eval_sequential_step_sampling: null
|
| 35 |
+
num_workers: 8
|
| 36 |
+
eval_num_workers: 8
|
| 37 |
+
prefetch_factor: 4
|
| 38 |
+
persistent_workers: true
|
| 39 |
+
pin_memory: true
|
| 40 |
+
shuffle: true
|
| 41 |
+
action_balance:
|
| 42 |
+
enabled: false
|
| 43 |
+
strategy: balanced_epoch
|
| 44 |
+
action_key: action_id
|
| 45 |
+
target_flap_fraction: 0.3
|
| 46 |
+
noop_id: 0
|
| 47 |
+
flap_id: 1
|
| 48 |
+
latency_curriculum:
|
| 49 |
+
enabled: false
|
| 50 |
+
strategy: exclusive
|
| 51 |
+
latencies: null
|
| 52 |
+
phase_steps: null
|
| 53 |
+
phase_distributions: null
|
| 54 |
+
new_latency_passes: 1.0
|
| 55 |
+
replay_passes: 0.25
|
| 56 |
+
target_total_passes: 2.0
|
| 57 |
+
final_equalization: true
|
| 58 |
+
step_budget_mode: auto
|
| 59 |
+
eval_at_phase_end: false
|
| 60 |
+
save_at_phase_end: false
|
| 61 |
+
computed_plan: null
|
| 62 |
+
per_device_batch_size: 32
|
| 63 |
+
load_all_data_for_training: true
|
| 64 |
+
num_obs_frames: 4
|
| 65 |
+
image_mode: stitch
|
| 66 |
+
prompt_mode: raw
|
| 67 |
+
stitch_grid:
|
| 68 |
+
- 2
|
| 69 |
+
- 2
|
| 70 |
+
obs_image_size: null
|
| 71 |
+
video_backend: torchvision_av
|
| 72 |
+
dataset:
|
| 73 |
+
source_hf: ''
|
| 74 |
+
config_name: null
|
| 75 |
+
source_subdir: null
|
| 76 |
+
converted_name: flappy_train
|
| 77 |
+
single_source_hf: ''
|
| 78 |
+
mixed_source_hf: ''
|
| 79 |
+
single_converted_name: flappy_train
|
| 80 |
+
mixed_converted_name: flappy_mixed_latency_train
|
| 81 |
+
single_latency_filter: null
|
| 82 |
+
mixed_latency_filter: null
|
| 83 |
+
force_download: false
|
| 84 |
+
setup_force: false
|
| 85 |
+
skip_verification: false
|
| 86 |
+
verify_rows: 200
|
| 87 |
+
max_episodes: null
|
| 88 |
+
episodes_per_latency: null
|
| 89 |
+
latency_filter: null
|
| 90 |
+
debug_subset:
|
| 91 |
+
enabled: false
|
| 92 |
+
max_episodes: 5
|
| 93 |
+
suffix: debug
|
| 94 |
+
base_model:
|
| 95 |
+
repo_id: Qwen/Qwen3-VL-4B-Instruct
|
| 96 |
+
initialization:
|
| 97 |
+
checkpoint_local_dir: playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
|
| 98 |
+
checkpoint_hf_repo_id: StarVLA/Qwen3VL-OFT-Bridge-RT-1
|
| 99 |
+
checkpoint_filename: checkpoints/steps_5000_pytorch_model.pt
|
| 100 |
+
trainer:
|
| 101 |
+
max_train_steps: 4000
|
| 102 |
+
num_warmup_steps: 100
|
| 103 |
+
save_interval: 500
|
| 104 |
+
eval_interval: 250
|
| 105 |
+
eval_num_batches: 50
|
| 106 |
+
per_latency_eval_num_batches: null
|
| 107 |
+
eval_action_classification: false
|
| 108 |
+
eval_action_classification_interval: null
|
| 109 |
+
cc_f1_tolerance: 1
|
| 110 |
+
learning_rate:
|
| 111 |
+
base: 2.0e-05
|
| 112 |
+
qwen_vl_interface: 1.0e-05
|
| 113 |
+
action_model: 0.0001
|
| 114 |
+
lr_scheduler_type: cosine_with_min_lr
|
| 115 |
+
scheduler_specific_kwargs:
|
| 116 |
+
min_lr: 1.0e-06
|
| 117 |
+
freeze_modules: ''
|
| 118 |
+
freeze_vit: false
|
| 119 |
+
freeze_tied_embedding: false
|
| 120 |
+
freeze_llm_layers: []
|
| 121 |
+
loss_scale:
|
| 122 |
+
vla: 1.0
|
| 123 |
+
vlm: 0.1
|
| 124 |
+
max_grad_norm: 1.0
|
| 125 |
+
weight_decay: 0.0
|
| 126 |
+
logging_frequency: 1
|
| 127 |
+
profile_timing:
|
| 128 |
+
enabled: false
|
| 129 |
+
log_interval: 10
|
| 130 |
+
gradient_clipping: 1.0
|
| 131 |
+
gradient_accumulation_steps: 2
|
| 132 |
+
distributed_backend: deepspeed
|
| 133 |
+
is_resume: false
|
| 134 |
+
pretrained_checkpoint: null
|
| 135 |
+
resume_step: 0
|
| 136 |
+
reload_modules: null
|
| 137 |
+
optimizer:
|
| 138 |
+
name: AdamW
|
| 139 |
+
betas:
|
| 140 |
+
- 0.9
|
| 141 |
+
- 0.95
|
| 142 |
+
eps: 1.0e-08
|
| 143 |
+
weight_decay: 1.0e-08
|
| 144 |
+
fused: true
|
| 145 |
+
save_format: pt
|
| 146 |
+
workspace_dir: WORKSPACE_DIR
|
| 147 |
+
run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
|
| 148 |
+
seed: 42
|
| 149 |
+
wandb_entity: saberrr-zju
|
| 150 |
+
wandb_project: starVLA_rl_games
|
| 151 |
+
auth:
|
| 152 |
+
env_file: null
|
| 153 |
+
hf_token_env: HF_TOKEN
|
| 154 |
+
wandb_api_key_env: WANDB_API_KEY
|
| 155 |
+
paths:
|
| 156 |
+
run_root_dir: results/Checkpoints
|
| 157 |
+
dataset_local_dir: data/flappy_fix_latency_2_200ep_7k2steps
|
| 158 |
+
dataset_cache_dir: null
|
| 159 |
+
base_model_dir: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 160 |
+
accelerate_config: starVLA/config/deepseeds/deepspeed_zero2.yaml
|
| 161 |
+
launch:
|
| 162 |
+
use_accelerate: true
|
| 163 |
+
gpus: null
|
| 164 |
+
num_processes: 1
|
| 165 |
+
dry_run: false
|
| 166 |
+
conda:
|
| 167 |
+
enabled: true
|
| 168 |
+
env_name: null
|
| 169 |
+
rl_games:
|
| 170 |
+
model_alias: openvla
|
| 171 |
+
env_eval:
|
| 172 |
+
image_size: 224
|
| 173 |
+
frameskip: 1
|
| 174 |
+
image_transform: raw_rgb
|
| 175 |
+
prompt_mode: raw
|
| 176 |
+
ghost_trail:
|
| 177 |
+
history_frames: 5
|
| 178 |
+
gamma: 1.3
|
| 179 |
+
min_alpha: 35
|
| 180 |
+
scroll_px_per_step: 4.0
|
| 181 |
+
ground_fraction: 0.22
|
| 182 |
+
seed: 42
|
| 183 |
+
fixed_episode_seeds: true
|
| 184 |
+
latency_seed_stride: 0
|
| 185 |
+
task_seed_stride: 0
|
| 186 |
+
task_description: ''
|
| 187 |
+
eval_parallel_envs: 5
|
| 188 |
+
enabled: true
|
| 189 |
+
eval_backend: latency_bench
|
| 190 |
+
distributed_mode: rank_sharded
|
| 191 |
+
vectorized:
|
| 192 |
+
enabled: false
|
| 193 |
+
batch_size: 1
|
| 194 |
+
latency:
|
| 195 |
+
prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
|
| 196 |
+
mode: single
|
| 197 |
+
values:
|
| 198 |
+
- 0
|
| 199 |
+
mid_train:
|
| 200 |
+
enabled: true
|
| 201 |
+
interval_steps: 250
|
| 202 |
+
latencies:
|
| 203 |
+
- 2
|
| 204 |
+
num_episodes: 20
|
| 205 |
+
max_steps_per_episode: 3600
|
| 206 |
+
post_train:
|
| 207 |
+
enabled: true
|
| 208 |
+
latencies:
|
| 209 |
+
- 2
|
| 210 |
+
num_episodes: 50
|
| 211 |
+
max_steps_per_episode: 3600
|
| 212 |
+
task: flappy
|
| 213 |
+
initialization_mode: bridge
|
| 214 |
+
action_carrier: bridge
|
| 215 |
+
model: openvla
|
| 216 |
+
env: flappy
|
| 217 |
+
init: bridge
|
| 218 |
+
bridge_base_model:
|
| 219 |
+
repo_id:
|
| 220 |
+
openvla: Qwen/Qwen3-VL-4B-Instruct
|
| 221 |
+
pi0: StarVLA/Qwen2.5-VL-3B-Instruct-Action
|
| 222 |
+
pi05: Qwen/Qwen3-VL-4B-Instruct
|
| 223 |
+
gr00t: Qwen/Qwen3-VL-4B-Instruct
|
| 224 |
+
local_dir:
|
| 225 |
+
openvla: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 226 |
+
pi0: playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
|
| 227 |
+
pi05: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 228 |
+
gr00t: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 229 |
+
mode: single
|
| 230 |
+
checkpoint:
|
| 231 |
+
load: none
|
| 232 |
+
hf_repo_id: null
|
| 233 |
+
save_best_model: false
|
| 234 |
+
save_final_model: true
|
| 235 |
+
save_pt_file: false
|
| 236 |
+
save_safetensors_file: true
|
| 237 |
+
local:
|
| 238 |
+
keep_last_n: 1
|
| 239 |
+
sync:
|
| 240 |
+
enabled: false
|
| 241 |
+
repo_id: null
|
| 242 |
+
keep_last_n: 0
|
| 243 |
+
sync_every_n_checkpoints: 1
|
| 244 |
+
resume_policy: local_latest
|
| 245 |
+
run_id: flappy_fix_latency_2_200ep_7k2steps_stitch
|
| 246 |
+
output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch
|
| 247 |
+
config_yaml: null
|
| 248 |
+
is_debug: false
|
| 249 |
+
version_id: '0.21'
|
flappy_fix_latency_2_200ep_7k2steps_stitch/config.yaml
ADDED
|
@@ -0,0 +1,102 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
checkpoint:
|
| 2 |
+
local:
|
| 3 |
+
keep_last_n: 1
|
| 4 |
+
save_best_model: false
|
| 5 |
+
save_final_model: true
|
| 6 |
+
save_pt_file: false
|
| 7 |
+
save_safetensors_file: true
|
| 8 |
+
sync:
|
| 9 |
+
enabled: false
|
| 10 |
+
keep_last_n: 0
|
| 11 |
+
repo_id: null
|
| 12 |
+
datasets:
|
| 13 |
+
vla_data:
|
| 14 |
+
data_mix: flappy_train__bridge
|
| 15 |
+
dataset_py: lerobot_datasets
|
| 16 |
+
eval_data_mix: flappy_train__bridge__val
|
| 17 |
+
latency_curriculum:
|
| 18 |
+
enabled: false
|
| 19 |
+
obs_image_size: null
|
| 20 |
+
per_device_batch_size: 32
|
| 21 |
+
framework:
|
| 22 |
+
action_model:
|
| 23 |
+
action_dim: 7
|
| 24 |
+
action_env_dim: 2
|
| 25 |
+
action_hidden_dim: 2560
|
| 26 |
+
action_horizon: 1
|
| 27 |
+
action_model_type: MLP
|
| 28 |
+
loss_type: discrete_ce
|
| 29 |
+
kv_memory:
|
| 30 |
+
enabled: false
|
| 31 |
+
packed_train: false
|
| 32 |
+
rebased_sink: true
|
| 33 |
+
rollout_len: 8
|
| 34 |
+
window: 4
|
| 35 |
+
name: QwenOFT
|
| 36 |
+
qwenvl:
|
| 37 |
+
attn_implementation: flash_attention_2
|
| 38 |
+
base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 39 |
+
enable_gradient_checkpointing: true
|
| 40 |
+
output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch
|
| 41 |
+
rl_games:
|
| 42 |
+
env_eval:
|
| 43 |
+
distributed_mode: rank_sharded
|
| 44 |
+
enabled: true
|
| 45 |
+
eval_backend: latency_bench
|
| 46 |
+
eval_parallel_envs: 5
|
| 47 |
+
fixed_episode_seeds: true
|
| 48 |
+
image_size: 224
|
| 49 |
+
image_transform: raw_rgb
|
| 50 |
+
latency:
|
| 51 |
+
prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
|
| 52 |
+
mid_train:
|
| 53 |
+
enabled: true
|
| 54 |
+
interval_steps: 250
|
| 55 |
+
latencies:
|
| 56 |
+
- 2
|
| 57 |
+
max_steps_per_episode: 3600
|
| 58 |
+
num_episodes: 20
|
| 59 |
+
prompt_mode: raw
|
| 60 |
+
seed: 42
|
| 61 |
+
model_alias: openvla
|
| 62 |
+
task: flappy
|
| 63 |
+
run_id: flappy_fix_latency_2_200ep_7k2steps_stitch
|
| 64 |
+
run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
|
| 65 |
+
seed: 42
|
| 66 |
+
trainer:
|
| 67 |
+
distributed_backend: deepspeed
|
| 68 |
+
eval_action_classification: false
|
| 69 |
+
eval_action_classification_interval: null
|
| 70 |
+
eval_interval: 250
|
| 71 |
+
eval_num_batches: 50
|
| 72 |
+
freeze_llm_layers: []
|
| 73 |
+
freeze_modules: ''
|
| 74 |
+
freeze_tied_embedding: false
|
| 75 |
+
freeze_vit: false
|
| 76 |
+
gradient_accumulation_steps: 2
|
| 77 |
+
is_resume: false
|
| 78 |
+
learning_rate:
|
| 79 |
+
action_model: 0.0001
|
| 80 |
+
base: 2.0e-05
|
| 81 |
+
qwen_vl_interface: 1.0e-05
|
| 82 |
+
logging_frequency: 1
|
| 83 |
+
lr_scheduler_type: cosine_with_min_lr
|
| 84 |
+
max_train_steps: 4000
|
| 85 |
+
num_warmup_steps: 100
|
| 86 |
+
optimizer:
|
| 87 |
+
betas:
|
| 88 |
+
- 0.9
|
| 89 |
+
- 0.95
|
| 90 |
+
eps: 1.0e-08
|
| 91 |
+
fused: true
|
| 92 |
+
weight_decay: 1.0e-08
|
| 93 |
+
per_latency_eval_num_batches: null
|
| 94 |
+
pretrained_checkpoint: null
|
| 95 |
+
profile_timing:
|
| 96 |
+
enabled: false
|
| 97 |
+
reload_modules: null
|
| 98 |
+
save_interval: 500
|
| 99 |
+
scheduler_specific_kwargs:
|
| 100 |
+
min_lr: 1.0e-06
|
| 101 |
+
wandb_entity: saberrr-zju
|
| 102 |
+
wandb_project: starVLA_rl_games
|
flappy_fix_latency_2_200ep_7k2steps_stitch/dataset_statistics.json
ADDED
|
@@ -0,0 +1,127 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"new_embodiment": {
|
| 3 |
+
"action": {
|
| 4 |
+
"mean": [
|
| 5 |
+
0.8029062747955322,
|
| 6 |
+
0.19709371030330658,
|
| 7 |
+
0.0,
|
| 8 |
+
0.0,
|
| 9 |
+
0.0,
|
| 10 |
+
0.0,
|
| 11 |
+
0.0
|
| 12 |
+
],
|
| 13 |
+
"std": [
|
| 14 |
+
0.395094633102417,
|
| 15 |
+
0.395094633102417,
|
| 16 |
+
0.0,
|
| 17 |
+
0.0,
|
| 18 |
+
0.0,
|
| 19 |
+
0.0,
|
| 20 |
+
0.0
|
| 21 |
+
],
|
| 22 |
+
"max": [
|
| 23 |
+
1.0,
|
| 24 |
+
1.0,
|
| 25 |
+
0.0,
|
| 26 |
+
0.0,
|
| 27 |
+
0.0,
|
| 28 |
+
0.0,
|
| 29 |
+
0.0
|
| 30 |
+
],
|
| 31 |
+
"min": [
|
| 32 |
+
0.0,
|
| 33 |
+
0.0,
|
| 34 |
+
0.0,
|
| 35 |
+
0.0,
|
| 36 |
+
0.0,
|
| 37 |
+
0.0,
|
| 38 |
+
0.0
|
| 39 |
+
],
|
| 40 |
+
"q01": [
|
| 41 |
+
0.0,
|
| 42 |
+
0.0,
|
| 43 |
+
0.0,
|
| 44 |
+
0.0,
|
| 45 |
+
0.0,
|
| 46 |
+
0.0,
|
| 47 |
+
0.0
|
| 48 |
+
],
|
| 49 |
+
"q99": [
|
| 50 |
+
1.0,
|
| 51 |
+
1.0,
|
| 52 |
+
0.0,
|
| 53 |
+
0.0,
|
| 54 |
+
0.0,
|
| 55 |
+
0.0,
|
| 56 |
+
0.0
|
| 57 |
+
],
|
| 58 |
+
"mask": [
|
| 59 |
+
true,
|
| 60 |
+
true,
|
| 61 |
+
true,
|
| 62 |
+
true,
|
| 63 |
+
true,
|
| 64 |
+
true,
|
| 65 |
+
true
|
| 66 |
+
]
|
| 67 |
+
},
|
| 68 |
+
"state": {
|
| 69 |
+
"mean": [
|
| 70 |
+
0.0,
|
| 71 |
+
0.0,
|
| 72 |
+
0.0,
|
| 73 |
+
0.0,
|
| 74 |
+
0.0,
|
| 75 |
+
0.0,
|
| 76 |
+
0.0
|
| 77 |
+
],
|
| 78 |
+
"std": [
|
| 79 |
+
0.0,
|
| 80 |
+
0.0,
|
| 81 |
+
0.0,
|
| 82 |
+
0.0,
|
| 83 |
+
0.0,
|
| 84 |
+
0.0,
|
| 85 |
+
0.0
|
| 86 |
+
],
|
| 87 |
+
"max": [
|
| 88 |
+
0.0,
|
| 89 |
+
0.0,
|
| 90 |
+
0.0,
|
| 91 |
+
0.0,
|
| 92 |
+
0.0,
|
| 93 |
+
0.0,
|
| 94 |
+
0.0
|
| 95 |
+
],
|
| 96 |
+
"min": [
|
| 97 |
+
0.0,
|
| 98 |
+
0.0,
|
| 99 |
+
0.0,
|
| 100 |
+
0.0,
|
| 101 |
+
0.0,
|
| 102 |
+
0.0,
|
| 103 |
+
0.0
|
| 104 |
+
],
|
| 105 |
+
"q01": [
|
| 106 |
+
0.0,
|
| 107 |
+
0.0,
|
| 108 |
+
0.0,
|
| 109 |
+
0.0,
|
| 110 |
+
0.0,
|
| 111 |
+
0.0,
|
| 112 |
+
0.0
|
| 113 |
+
],
|
| 114 |
+
"q99": [
|
| 115 |
+
0.0,
|
| 116 |
+
0.0,
|
| 117 |
+
0.0,
|
| 118 |
+
0.0,
|
| 119 |
+
0.0,
|
| 120 |
+
0.0,
|
| 121 |
+
0.0
|
| 122 |
+
]
|
| 123 |
+
},
|
| 124 |
+
"num_transitions": 1291269,
|
| 125 |
+
"num_trajectories": 180
|
| 126 |
+
}
|
| 127 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/dataset_statistics_eval.json
ADDED
|
@@ -0,0 +1,127 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"new_embodiment": {
|
| 3 |
+
"action": {
|
| 4 |
+
"mean": [
|
| 5 |
+
0.8033548593521118,
|
| 6 |
+
0.19664514064788818,
|
| 7 |
+
0.0,
|
| 8 |
+
0.0,
|
| 9 |
+
0.0,
|
| 10 |
+
0.0,
|
| 11 |
+
0.0
|
| 12 |
+
],
|
| 13 |
+
"std": [
|
| 14 |
+
0.39764848351478577,
|
| 15 |
+
0.39764848351478577,
|
| 16 |
+
0.0,
|
| 17 |
+
0.0,
|
| 18 |
+
0.0,
|
| 19 |
+
0.0,
|
| 20 |
+
0.0
|
| 21 |
+
],
|
| 22 |
+
"max": [
|
| 23 |
+
1.0,
|
| 24 |
+
1.0,
|
| 25 |
+
0.0,
|
| 26 |
+
0.0,
|
| 27 |
+
0.0,
|
| 28 |
+
0.0,
|
| 29 |
+
0.0
|
| 30 |
+
],
|
| 31 |
+
"min": [
|
| 32 |
+
0.0,
|
| 33 |
+
0.0,
|
| 34 |
+
0.0,
|
| 35 |
+
0.0,
|
| 36 |
+
0.0,
|
| 37 |
+
0.0,
|
| 38 |
+
0.0
|
| 39 |
+
],
|
| 40 |
+
"q01": [
|
| 41 |
+
0.0,
|
| 42 |
+
0.0,
|
| 43 |
+
0.0,
|
| 44 |
+
0.0,
|
| 45 |
+
0.0,
|
| 46 |
+
0.0,
|
| 47 |
+
0.0
|
| 48 |
+
],
|
| 49 |
+
"q99": [
|
| 50 |
+
1.0,
|
| 51 |
+
1.0,
|
| 52 |
+
0.0,
|
| 53 |
+
0.0,
|
| 54 |
+
0.0,
|
| 55 |
+
0.0,
|
| 56 |
+
0.0
|
| 57 |
+
],
|
| 58 |
+
"mask": [
|
| 59 |
+
true,
|
| 60 |
+
true,
|
| 61 |
+
true,
|
| 62 |
+
true,
|
| 63 |
+
true,
|
| 64 |
+
true,
|
| 65 |
+
true
|
| 66 |
+
]
|
| 67 |
+
},
|
| 68 |
+
"state": {
|
| 69 |
+
"mean": [
|
| 70 |
+
0.0,
|
| 71 |
+
0.0,
|
| 72 |
+
0.0,
|
| 73 |
+
0.0,
|
| 74 |
+
0.0,
|
| 75 |
+
0.0,
|
| 76 |
+
0.0
|
| 77 |
+
],
|
| 78 |
+
"std": [
|
| 79 |
+
0.0,
|
| 80 |
+
0.0,
|
| 81 |
+
0.0,
|
| 82 |
+
0.0,
|
| 83 |
+
0.0,
|
| 84 |
+
0.0,
|
| 85 |
+
0.0
|
| 86 |
+
],
|
| 87 |
+
"max": [
|
| 88 |
+
0.0,
|
| 89 |
+
0.0,
|
| 90 |
+
0.0,
|
| 91 |
+
0.0,
|
| 92 |
+
0.0,
|
| 93 |
+
0.0,
|
| 94 |
+
0.0
|
| 95 |
+
],
|
| 96 |
+
"min": [
|
| 97 |
+
0.0,
|
| 98 |
+
0.0,
|
| 99 |
+
0.0,
|
| 100 |
+
0.0,
|
| 101 |
+
0.0,
|
| 102 |
+
0.0,
|
| 103 |
+
0.0
|
| 104 |
+
],
|
| 105 |
+
"q01": [
|
| 106 |
+
0.0,
|
| 107 |
+
0.0,
|
| 108 |
+
0.0,
|
| 109 |
+
0.0,
|
| 110 |
+
0.0,
|
| 111 |
+
0.0,
|
| 112 |
+
0.0
|
| 113 |
+
],
|
| 114 |
+
"q99": [
|
| 115 |
+
0.0,
|
| 116 |
+
0.0,
|
| 117 |
+
0.0,
|
| 118 |
+
0.0,
|
| 119 |
+
0.0,
|
| 120 |
+
0.0,
|
| 121 |
+
0.0
|
| 122 |
+
]
|
| 123 |
+
},
|
| 124 |
+
"num_transitions": 143553,
|
| 125 |
+
"num_trajectories": 20
|
| 126 |
+
}
|
| 127 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1000.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 146.23500173576176,
|
| 7 |
+
"mean_length": 1196.4,
|
| 8 |
+
"std_reward": 140.56170437747195,
|
| 9 |
+
"std_length": 1133.7973981271964,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
6.500000096857548,
|
| 12 |
+
176.40000209212303,
|
| 13 |
+
174.80000206828117,
|
| 14 |
+
3.90000007301569,
|
| 15 |
+
127.50000151246786,
|
| 16 |
+
6.500000096857548,
|
| 17 |
+
288.4000034034252,
|
| 18 |
+
6.500000096857548,
|
| 19 |
+
6.70000009983778,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
3.90000007301569,
|
| 22 |
+
232.40000274777412,
|
| 23 |
+
138.90000165253878,
|
| 24 |
+
3.90000007301569,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
6.500000096857548,
|
| 27 |
+
249.00000293552876,
|
| 28 |
+
138.90000165253878,
|
| 29 |
+
190.4000022560358,
|
| 30 |
+
274.40000323951244
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
67,
|
| 34 |
+
1442,
|
| 35 |
+
1426,
|
| 36 |
+
50,
|
| 37 |
+
1043,
|
| 38 |
+
67,
|
| 39 |
+
2346,
|
| 40 |
+
67,
|
| 41 |
+
69,
|
| 42 |
+
3600,
|
| 43 |
+
50,
|
| 44 |
+
1894,
|
| 45 |
+
1139,
|
| 46 |
+
50,
|
| 47 |
+
3600,
|
| 48 |
+
67,
|
| 49 |
+
2024,
|
| 50 |
+
1139,
|
| 51 |
+
1555,
|
| 52 |
+
2233
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 1000,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 146.23500173576176,
|
| 112 |
+
"mean_length": 1196.4,
|
| 113 |
+
"std_reward": 140.56170437747195,
|
| 114 |
+
"std_length": 1133.7973981271964,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 146.23500173576176,
|
| 117 |
+
"macro_mean_length": 1196.4,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1250.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 280.7200033083558,
|
| 7 |
+
"mean_length": 2280.2,
|
| 8 |
+
"std_reward": 160.46691622314893,
|
| 9 |
+
"std_length": 1292.9992111366503,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
57.500000692903996,
|
| 12 |
+
113.50000134855509,
|
| 13 |
+
32.80000041425228,
|
| 14 |
+
393.50000462681055,
|
| 15 |
+
277.0000032633543,
|
| 16 |
+
46.800000578165054,
|
| 17 |
+
291.0000034272671,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
169.50000200420618,
|
| 20 |
+
342.5000040307641,
|
| 21 |
+
333.0000039190054,
|
| 22 |
+
37.300000466406345,
|
| 23 |
+
326.8000038564205,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
81.00000096857548,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
478,
|
| 34 |
+
930,
|
| 35 |
+
285,
|
| 36 |
+
3190,
|
| 37 |
+
2250,
|
| 38 |
+
398,
|
| 39 |
+
2363,
|
| 40 |
+
3600,
|
| 41 |
+
1382,
|
| 42 |
+
2779,
|
| 43 |
+
2702,
|
| 44 |
+
321,
|
| 45 |
+
2658,
|
| 46 |
+
3600,
|
| 47 |
+
668,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 1250,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 280.7200033083558,
|
| 112 |
+
"mean_length": 2280.2,
|
| 113 |
+
"std_reward": 160.46691622314893,
|
| 114 |
+
"std_length": 1292.9992111366503,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 280.7200033083558,
|
| 117 |
+
"macro_mean_length": 2280.2,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1500.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 123.54500146694481,
|
| 7 |
+
"mean_length": 1011.45,
|
| 8 |
+
"std_reward": 120.46388593553634,
|
| 9 |
+
"std_length": 971.7632672106926,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
57.500000692903996,
|
| 12 |
+
113.50000134855509,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
67.0000008046627,
|
| 15 |
+
123.0000014603138,
|
| 16 |
+
244.5000028833747,
|
| 17 |
+
137.00000162422657,
|
| 18 |
+
155.5000018402934,
|
| 19 |
+
211.5000024959445,
|
| 20 |
+
6.800000101327896,
|
| 21 |
+
11.100000150501728,
|
| 22 |
+
85.50000102072954,
|
| 23 |
+
6.800000101327896,
|
| 24 |
+
333.1000039204955,
|
| 25 |
+
6.800000101327896,
|
| 26 |
+
43.80000053346157,
|
| 27 |
+
90.50000108033419,
|
| 28 |
+
291.0000034272671,
|
| 29 |
+
34.60000042617321,
|
| 30 |
+
6.800000101327896
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
478,
|
| 34 |
+
930,
|
| 35 |
+
3600,
|
| 36 |
+
555,
|
| 37 |
+
1007,
|
| 38 |
+
1988,
|
| 39 |
+
1120,
|
| 40 |
+
1269,
|
| 41 |
+
1721,
|
| 42 |
+
70,
|
| 43 |
+
104,
|
| 44 |
+
704,
|
| 45 |
+
70,
|
| 46 |
+
2703,
|
| 47 |
+
70,
|
| 48 |
+
368,
|
| 49 |
+
745,
|
| 50 |
+
2363,
|
| 51 |
+
294,
|
| 52 |
+
70
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 1500,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 123.54500146694481,
|
| 112 |
+
"mean_length": 1011.45,
|
| 113 |
+
"std_reward": 120.46388593553634,
|
| 114 |
+
"std_length": 971.7632672106926,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 123.54500146694481,
|
| 117 |
+
"macro_mean_length": 1011.45,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_1750.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 360.8600042447448,
|
| 7 |
+
"mean_length": 2925.3,
|
| 8 |
+
"std_reward": 138.3481761636961,
|
| 9 |
+
"std_length": 1115.07690766153,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
123.0000014603138,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
431.0000050663948,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
45.90000056475401,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
151.00000178813934,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
333.0000039190054,
|
| 22 |
+
272.50000321120024,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
81.00000096857548,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
3600,
|
| 35 |
+
1007,
|
| 36 |
+
3600,
|
| 37 |
+
3493,
|
| 38 |
+
3600,
|
| 39 |
+
389,
|
| 40 |
+
3600,
|
| 41 |
+
1233,
|
| 42 |
+
3600,
|
| 43 |
+
2702,
|
| 44 |
+
2214,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
668,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 1750,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 360.8600042447448,
|
| 112 |
+
"mean_length": 2925.3,
|
| 113 |
+
"std_reward": 138.3481761636961,
|
| 114 |
+
"std_length": 1115.07690766153,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 360.8600042447448,
|
| 117 |
+
"macro_mean_length": 2925.3,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2000.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 360.0050042357296,
|
| 7 |
+
"mean_length": 2918.9,
|
| 8 |
+
"std_reward": 151.56523681917494,
|
| 9 |
+
"std_length": 1220.8479389342476,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
176.40000209212303,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
440.80000518262386,
|
| 16 |
+
8.400000125169754,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
180.9000021442771,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
8.400000125169754,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
160.8000019043684,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
1442,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3573,
|
| 38 |
+
86,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
1478,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
86,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
1313,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 2000,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 360.0050042357296,
|
| 112 |
+
"mean_length": 2918.9,
|
| 113 |
+
"std_reward": 151.56523681917494,
|
| 114 |
+
"std_length": 1220.8479389342476,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 360.0050042357296,
|
| 117 |
+
"macro_mean_length": 2918.9,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2250.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 444.6000052243471,
|
| 7 |
+
"mean_length": 3600.0,
|
| 8 |
+
"std_reward": 0.0,
|
| 9 |
+
"std_length": 0.0,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
3600,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3600,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 2250,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 444.6000052243471,
|
| 112 |
+
"mean_length": 3600.0,
|
| 113 |
+
"std_reward": 0.0,
|
| 114 |
+
"std_length": 0.0,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 444.6000052243471,
|
| 117 |
+
"macro_mean_length": 3600.0,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_250.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 4.260000076889992,
|
| 7 |
+
"mean_length": 52.7,
|
| 8 |
+
"std_reward": 0.6703730361608478,
|
| 9 |
+
"std_length": 4.160528812542944,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
3.90000007301569,
|
| 12 |
+
3.90000007301569,
|
| 13 |
+
4.4000000804662704,
|
| 14 |
+
4.300000078976154,
|
| 15 |
+
3.90000007301569,
|
| 16 |
+
3.90000007301569,
|
| 17 |
+
3.90000007301569,
|
| 18 |
+
3.90000007301569,
|
| 19 |
+
4.200000077486038,
|
| 20 |
+
3.90000007301569,
|
| 21 |
+
4.300000078976154,
|
| 22 |
+
4.200000077486038,
|
| 23 |
+
6.200000092387199,
|
| 24 |
+
4.300000078976154,
|
| 25 |
+
6.200000092387199,
|
| 26 |
+
3.90000007301569,
|
| 27 |
+
3.90000007301569,
|
| 28 |
+
4.200000077486038,
|
| 29 |
+
3.90000007301569,
|
| 30 |
+
3.90000007301569
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
50,
|
| 34 |
+
50,
|
| 35 |
+
55,
|
| 36 |
+
54,
|
| 37 |
+
50,
|
| 38 |
+
50,
|
| 39 |
+
50,
|
| 40 |
+
50,
|
| 41 |
+
53,
|
| 42 |
+
50,
|
| 43 |
+
54,
|
| 44 |
+
53,
|
| 45 |
+
64,
|
| 46 |
+
54,
|
| 47 |
+
64,
|
| 48 |
+
50,
|
| 49 |
+
50,
|
| 50 |
+
53,
|
| 51 |
+
50,
|
| 52 |
+
50
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 250,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 4.260000076889992,
|
| 112 |
+
"mean_length": 52.7,
|
| 113 |
+
"std_reward": 0.6703730361608478,
|
| 114 |
+
"std_length": 4.160528812542944,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 4.260000076889992,
|
| 117 |
+
"macro_mean_length": 52.7,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2500.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 374.0650043990463,
|
| 7 |
+
"mean_length": 3031.5,
|
| 8 |
+
"std_reward": 132.23581089941655,
|
| 9 |
+
"std_length": 1065.9950046787274,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
25.300000317394733,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
109.30000130087137,
|
| 16 |
+
183.8000021725893,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
160.8000019043684,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
333.1000039204955,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
219,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
897,
|
| 38 |
+
1498,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
1313,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
2703,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 2500,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 374.0650043990463,
|
| 112 |
+
"mean_length": 3031.5,
|
| 113 |
+
"std_reward": 132.23581089941655,
|
| 114 |
+
"std_length": 1065.9950046787274,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 374.0650043990463,
|
| 117 |
+
"macro_mean_length": 3031.5,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_2750.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 406.0250047739595,
|
| 7 |
+
"mean_length": 3289.7,
|
| 8 |
+
"std_reward": 116.08755398484,
|
| 9 |
+
"std_length": 935.4420398934399,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
117.00000140070915,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
438.8000051677227,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
6.500000096857548,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
965,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3562,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
67,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 2750,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 406.0250047739595,
|
| 112 |
+
"mean_length": 3289.7,
|
| 113 |
+
"std_reward": 116.08755398484,
|
| 114 |
+
"std_length": 935.4420398934399,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 406.0250047739595,
|
| 117 |
+
"macro_mean_length": 3289.7,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3000.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 364.3000042848289,
|
| 7 |
+
"mean_length": 2952.95,
|
| 8 |
+
"std_reward": 144.07553743043889,
|
| 9 |
+
"std_length": 1161.7599784378872,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
11.100000150501728,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
431.1000050678849,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
34.60000042617321,
|
| 23 |
+
258.6000030487776,
|
| 24 |
+
244.6000028848648,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
417.10000490397215,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
109.10000129789114
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
3600,
|
| 35 |
+
3600,
|
| 36 |
+
104,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3600,
|
| 42 |
+
3494,
|
| 43 |
+
3600,
|
| 44 |
+
294,
|
| 45 |
+
2102,
|
| 46 |
+
1989,
|
| 47 |
+
3600,
|
| 48 |
+
3381,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
895
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 3000,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 364.3000042848289,
|
| 112 |
+
"mean_length": 2952.95,
|
| 113 |
+
"std_reward": 144.07553743043889,
|
| 114 |
+
"std_length": 1161.7599784378872,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 364.3000042848289,
|
| 117 |
+
"macro_mean_length": 2952.95,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3250.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 339.66000399664046,
|
| 7 |
+
"mean_length": 2754.15,
|
| 8 |
+
"std_reward": 174.21704311057604,
|
| 9 |
+
"std_length": 1404.42996532401,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
43.80000053346157,
|
| 14 |
+
11.100000150501728,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
29.800000369548798,
|
| 20 |
+
18.50000024586916,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
99.80000118911266,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
365.80000430345535
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
3600,
|
| 35 |
+
368,
|
| 36 |
+
104,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
255,
|
| 42 |
+
169,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
820,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
2967
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 3250,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 339.66000399664046,
|
| 112 |
+
"mean_length": 2754.15,
|
| 113 |
+
"std_reward": 174.21704311057604,
|
| 114 |
+
"std_length": 1404.42996532401,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 339.66000399664046,
|
| 117 |
+
"macro_mean_length": 2754.15,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3500.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 405.8750047717243,
|
| 7 |
+
"mean_length": 3288.3,
|
| 8 |
+
"std_reward": 106.27140320430965,
|
| 9 |
+
"std_length": 855.9304936734057,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
183.8000021725893,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
18.50000024586916,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
435.8000051230192,
|
| 30 |
+
365.80000430345535
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
3600,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
1498,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3600,
|
| 42 |
+
169,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3532,
|
| 52 |
+
2967
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 3500,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 405.8750047717243,
|
| 112 |
+
"mean_length": 3288.3,
|
| 113 |
+
"std_reward": 106.27140320430965,
|
| 114 |
+
"std_length": 855.9304936734057,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 405.8750047717243,
|
| 117 |
+
"macro_mean_length": 3288.3,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_3750.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 437.42000514045355,
|
| 7 |
+
"mean_length": 3542.35,
|
| 8 |
+
"std_reward": 21.653443397232223,
|
| 9 |
+
"std_length": 173.87043308164849,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
379.8000044673681,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
365.80000430345535
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
3600,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3600,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3080,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
2967
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 3750,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 437.42000514045355,
|
| 112 |
+
"mean_length": 3542.35,
|
| 113 |
+
"std_reward": 21.653443397232223,
|
| 114 |
+
"std_length": 173.87043308164849,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 437.42000514045355,
|
| 117 |
+
"macro_mean_length": 3542.35,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_4000.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 411.3150048356503,
|
| 7 |
+
"mean_length": 3332.25,
|
| 8 |
+
"std_reward": 98.88728180982324,
|
| 9 |
+
"std_length": 796.8478446353482,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
118.50000140815973,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
110.90000132471323,
|
| 19 |
+
438.7000051662326,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
971,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
913,
|
| 41 |
+
3561,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 4000,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 411.3150048356503,
|
| 112 |
+
"mean_length": 3332.25,
|
| 113 |
+
"std_reward": 98.88728180982324,
|
| 114 |
+
"std_length": 796.8478446353482,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 411.3150048356503,
|
| 117 |
+
"macro_mean_length": 3332.25,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_500.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 18.025000237300993,
|
| 7 |
+
"mean_length": 163.35,
|
| 8 |
+
"std_reward": 46.5835692673937,
|
| 9 |
+
"std_length": 375.20144922428005,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
4.900000087916851,
|
| 12 |
+
6.800000101327896,
|
| 13 |
+
4.500000081956387,
|
| 14 |
+
3.90000007301569,
|
| 15 |
+
6.800000101327896,
|
| 16 |
+
4.900000087916851,
|
| 17 |
+
4.800000086426735,
|
| 18 |
+
4.900000087916851,
|
| 19 |
+
6.800000101327896,
|
| 20 |
+
48.7000005915761,
|
| 21 |
+
3.90000007301569,
|
| 22 |
+
6.800000101327896,
|
| 23 |
+
4.900000087916851,
|
| 24 |
+
3.90000007301569,
|
| 25 |
+
216.8000025600195,
|
| 26 |
+
4.900000087916851,
|
| 27 |
+
6.800000101327896,
|
| 28 |
+
6.800000101327896,
|
| 29 |
+
4.800000086426735,
|
| 30 |
+
3.90000007301569
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
60,
|
| 34 |
+
70,
|
| 35 |
+
56,
|
| 36 |
+
50,
|
| 37 |
+
70,
|
| 38 |
+
60,
|
| 39 |
+
59,
|
| 40 |
+
60,
|
| 41 |
+
70,
|
| 42 |
+
408,
|
| 43 |
+
50,
|
| 44 |
+
70,
|
| 45 |
+
60,
|
| 46 |
+
50,
|
| 47 |
+
1765,
|
| 48 |
+
60,
|
| 49 |
+
70,
|
| 50 |
+
70,
|
| 51 |
+
59,
|
| 52 |
+
50
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 500,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 18.025000237300993,
|
| 112 |
+
"mean_length": 163.35,
|
| 113 |
+
"std_reward": 46.5835692673937,
|
| 114 |
+
"std_length": 375.20144922428005,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 18.025000237300993,
|
| 117 |
+
"macro_mean_length": 163.35,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/mid_train/step_750.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 11.12500015757978,
|
| 7 |
+
"mean_length": 108.3,
|
| 8 |
+
"std_reward": 17.37244605595043,
|
| 9 |
+
"std_length": 138.48360913841032,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
4.600000083446503,
|
| 12 |
+
4.900000087916851,
|
| 13 |
+
3.90000007301569,
|
| 14 |
+
3.90000007301569,
|
| 15 |
+
4.900000087916851,
|
| 16 |
+
4.600000083446503,
|
| 17 |
+
3.90000007301569,
|
| 18 |
+
4.600000083446503,
|
| 19 |
+
71.50000085681677,
|
| 20 |
+
43.50000052899122,
|
| 21 |
+
3.90000007301569,
|
| 22 |
+
3.90000007301569,
|
| 23 |
+
3.90000007301569,
|
| 24 |
+
3.90000007301569,
|
| 25 |
+
3.90000007301569,
|
| 26 |
+
4.600000083446503,
|
| 27 |
+
4.900000087916851,
|
| 28 |
+
3.90000007301569,
|
| 29 |
+
4.800000086426735,
|
| 30 |
+
34.500000424683094
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
57,
|
| 34 |
+
60,
|
| 35 |
+
50,
|
| 36 |
+
50,
|
| 37 |
+
60,
|
| 38 |
+
57,
|
| 39 |
+
50,
|
| 40 |
+
57,
|
| 41 |
+
591,
|
| 42 |
+
365,
|
| 43 |
+
50,
|
| 44 |
+
50,
|
| 45 |
+
50,
|
| 46 |
+
50,
|
| 47 |
+
50,
|
| 48 |
+
57,
|
| 49 |
+
60,
|
| 50 |
+
50,
|
| 51 |
+
59,
|
| 52 |
+
293
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 750,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 11.12500015757978,
|
| 112 |
+
"mean_length": 108.3,
|
| 113 |
+
"std_reward": 17.37244605595043,
|
| 114 |
+
"std_length": 138.48360913841032,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 11.12500015757978,
|
| 117 |
+
"macro_mean_length": 108.3,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/eval/post_train/step_4000.json
ADDED
|
@@ -0,0 +1,240 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 50,
|
| 6 |
+
"mean_reward": 414.16800486892464,
|
| 7 |
+
"mean_length": 3355.18,
|
| 8 |
+
"std_reward": 87.76956622971467,
|
| 9 |
+
"std_length": 707.0275154475956,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
118.50000140815973,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
110.90000132471323,
|
| 19 |
+
438.7000051662326,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471,
|
| 31 |
+
444.6000052243471,
|
| 32 |
+
444.6000052243471,
|
| 33 |
+
444.6000052243471,
|
| 34 |
+
444.6000052243471,
|
| 35 |
+
444.6000052243471,
|
| 36 |
+
444.6000052243471,
|
| 37 |
+
444.6000052243471,
|
| 38 |
+
444.6000052243471,
|
| 39 |
+
214.6000025421381,
|
| 40 |
+
444.6000052243471,
|
| 41 |
+
444.6000052243471,
|
| 42 |
+
444.6000052243471,
|
| 43 |
+
444.6000052243471,
|
| 44 |
+
444.6000052243471,
|
| 45 |
+
155.80000184476376,
|
| 46 |
+
444.6000052243471,
|
| 47 |
+
444.6000052243471,
|
| 48 |
+
444.6000052243471,
|
| 49 |
+
444.6000052243471,
|
| 50 |
+
444.6000052243471,
|
| 51 |
+
444.6000052243471,
|
| 52 |
+
174.50000206381083,
|
| 53 |
+
377.60000444948673,
|
| 54 |
+
444.6000052243471,
|
| 55 |
+
444.6000052243471,
|
| 56 |
+
444.6000052243471,
|
| 57 |
+
444.6000052243471,
|
| 58 |
+
444.6000052243471,
|
| 59 |
+
444.6000052243471,
|
| 60 |
+
444.6000052243471
|
| 61 |
+
],
|
| 62 |
+
"episode_lengths": [
|
| 63 |
+
3600,
|
| 64 |
+
971,
|
| 65 |
+
3600,
|
| 66 |
+
3600,
|
| 67 |
+
3600,
|
| 68 |
+
3600,
|
| 69 |
+
3600,
|
| 70 |
+
913,
|
| 71 |
+
3561,
|
| 72 |
+
3600,
|
| 73 |
+
3600,
|
| 74 |
+
3600,
|
| 75 |
+
3600,
|
| 76 |
+
3600,
|
| 77 |
+
3600,
|
| 78 |
+
3600,
|
| 79 |
+
3600,
|
| 80 |
+
3600,
|
| 81 |
+
3600,
|
| 82 |
+
3600,
|
| 83 |
+
3600,
|
| 84 |
+
3600,
|
| 85 |
+
3600,
|
| 86 |
+
3600,
|
| 87 |
+
3600,
|
| 88 |
+
3600,
|
| 89 |
+
3600,
|
| 90 |
+
3600,
|
| 91 |
+
1752,
|
| 92 |
+
3600,
|
| 93 |
+
3600,
|
| 94 |
+
3600,
|
| 95 |
+
3600,
|
| 96 |
+
3600,
|
| 97 |
+
1272,
|
| 98 |
+
3600,
|
| 99 |
+
3600,
|
| 100 |
+
3600,
|
| 101 |
+
3600,
|
| 102 |
+
3600,
|
| 103 |
+
3600,
|
| 104 |
+
1423,
|
| 105 |
+
3067,
|
| 106 |
+
3600,
|
| 107 |
+
3600,
|
| 108 |
+
3600,
|
| 109 |
+
3600,
|
| 110 |
+
3600,
|
| 111 |
+
3600,
|
| 112 |
+
3600
|
| 113 |
+
],
|
| 114 |
+
"decoded_action_hist": {},
|
| 115 |
+
"fixed_episode_seeds": true,
|
| 116 |
+
"eval_seed": 42,
|
| 117 |
+
"episode_seeds": [
|
| 118 |
+
null,
|
| 119 |
+
null,
|
| 120 |
+
null,
|
| 121 |
+
null,
|
| 122 |
+
null,
|
| 123 |
+
null,
|
| 124 |
+
null,
|
| 125 |
+
null,
|
| 126 |
+
null,
|
| 127 |
+
null,
|
| 128 |
+
null,
|
| 129 |
+
null,
|
| 130 |
+
null,
|
| 131 |
+
null,
|
| 132 |
+
null,
|
| 133 |
+
null,
|
| 134 |
+
null,
|
| 135 |
+
null,
|
| 136 |
+
null,
|
| 137 |
+
null,
|
| 138 |
+
null,
|
| 139 |
+
null,
|
| 140 |
+
null,
|
| 141 |
+
null,
|
| 142 |
+
null,
|
| 143 |
+
null,
|
| 144 |
+
null,
|
| 145 |
+
null,
|
| 146 |
+
null,
|
| 147 |
+
null,
|
| 148 |
+
null,
|
| 149 |
+
null,
|
| 150 |
+
null,
|
| 151 |
+
null,
|
| 152 |
+
null,
|
| 153 |
+
null,
|
| 154 |
+
null,
|
| 155 |
+
null,
|
| 156 |
+
null,
|
| 157 |
+
null,
|
| 158 |
+
null,
|
| 159 |
+
null,
|
| 160 |
+
null,
|
| 161 |
+
null,
|
| 162 |
+
null,
|
| 163 |
+
null,
|
| 164 |
+
null,
|
| 165 |
+
null,
|
| 166 |
+
null,
|
| 167 |
+
null
|
| 168 |
+
],
|
| 169 |
+
"episode_indices": [
|
| 170 |
+
0,
|
| 171 |
+
1,
|
| 172 |
+
2,
|
| 173 |
+
3,
|
| 174 |
+
4,
|
| 175 |
+
5,
|
| 176 |
+
6,
|
| 177 |
+
7,
|
| 178 |
+
8,
|
| 179 |
+
9,
|
| 180 |
+
10,
|
| 181 |
+
11,
|
| 182 |
+
12,
|
| 183 |
+
13,
|
| 184 |
+
14,
|
| 185 |
+
15,
|
| 186 |
+
16,
|
| 187 |
+
17,
|
| 188 |
+
18,
|
| 189 |
+
19,
|
| 190 |
+
20,
|
| 191 |
+
21,
|
| 192 |
+
22,
|
| 193 |
+
23,
|
| 194 |
+
24,
|
| 195 |
+
25,
|
| 196 |
+
26,
|
| 197 |
+
27,
|
| 198 |
+
28,
|
| 199 |
+
29,
|
| 200 |
+
30,
|
| 201 |
+
31,
|
| 202 |
+
32,
|
| 203 |
+
33,
|
| 204 |
+
34,
|
| 205 |
+
35,
|
| 206 |
+
36,
|
| 207 |
+
37,
|
| 208 |
+
38,
|
| 209 |
+
39,
|
| 210 |
+
40,
|
| 211 |
+
41,
|
| 212 |
+
42,
|
| 213 |
+
43,
|
| 214 |
+
44,
|
| 215 |
+
45,
|
| 216 |
+
46,
|
| 217 |
+
47,
|
| 218 |
+
48,
|
| 219 |
+
49
|
| 220 |
+
]
|
| 221 |
+
}
|
| 222 |
+
},
|
| 223 |
+
"aggregate": {
|
| 224 |
+
"stage": "post_train",
|
| 225 |
+
"step": 4000,
|
| 226 |
+
"task": "flappy",
|
| 227 |
+
"model_alias": "openvla",
|
| 228 |
+
"fixed_episode_seeds": true,
|
| 229 |
+
"eval_seed": 42,
|
| 230 |
+
"total_episodes": 50,
|
| 231 |
+
"mean_reward": 414.16800486892464,
|
| 232 |
+
"mean_length": 3355.18,
|
| 233 |
+
"std_reward": 87.76956622971467,
|
| 234 |
+
"std_length": 707.0275154475956,
|
| 235 |
+
"task_count": 1,
|
| 236 |
+
"macro_mean_reward": 414.16800486892464,
|
| 237 |
+
"macro_mean_length": 3355.18,
|
| 238 |
+
"distributed_eval": true
|
| 239 |
+
}
|
| 240 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/config.yaml
ADDED
|
@@ -0,0 +1,247 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
framework:
|
| 2 |
+
qwenvl:
|
| 3 |
+
base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 4 |
+
attn_implementation: flash_attention_2
|
| 5 |
+
flex_backend: triton
|
| 6 |
+
enable_gradient_checkpointing: true
|
| 7 |
+
action_model:
|
| 8 |
+
state_dim: 7
|
| 9 |
+
loss_type: discrete_ce
|
| 10 |
+
action_horizon: 1
|
| 11 |
+
future_action_window_size: 0
|
| 12 |
+
past_action_window_size: 0
|
| 13 |
+
action_dim: 7
|
| 14 |
+
action_env_dim: 2
|
| 15 |
+
kv_memory:
|
| 16 |
+
enabled: false
|
| 17 |
+
window: 4
|
| 18 |
+
rollout_len: 8
|
| 19 |
+
packed_train: false
|
| 20 |
+
rebased_sink: true
|
| 21 |
+
name: QwenOFT
|
| 22 |
+
datasets:
|
| 23 |
+
vla_data:
|
| 24 |
+
dataset_py: lerobot_datasets
|
| 25 |
+
include_state: true
|
| 26 |
+
data_root_dir: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
|
| 27 |
+
data_mix: flappy_train__bridge
|
| 28 |
+
eval_data_mix: flappy_train__bridge__val
|
| 29 |
+
custom_mixtures_path: null
|
| 30 |
+
action_type: discrete
|
| 31 |
+
sequential_step_sampling: false
|
| 32 |
+
eval_sequential_step_sampling: null
|
| 33 |
+
num_workers: 8
|
| 34 |
+
eval_num_workers: 8
|
| 35 |
+
prefetch_factor: 4
|
| 36 |
+
persistent_workers: true
|
| 37 |
+
pin_memory: true
|
| 38 |
+
shuffle: true
|
| 39 |
+
action_balance:
|
| 40 |
+
enabled: false
|
| 41 |
+
strategy: balanced_epoch
|
| 42 |
+
action_key: action_id
|
| 43 |
+
target_flap_fraction: 0.3
|
| 44 |
+
noop_id: 0
|
| 45 |
+
flap_id: 1
|
| 46 |
+
latency_curriculum:
|
| 47 |
+
enabled: false
|
| 48 |
+
strategy: exclusive
|
| 49 |
+
latencies: null
|
| 50 |
+
phase_steps: null
|
| 51 |
+
phase_distributions: null
|
| 52 |
+
new_latency_passes: 1.0
|
| 53 |
+
replay_passes: 0.25
|
| 54 |
+
target_total_passes: 2.0
|
| 55 |
+
final_equalization: true
|
| 56 |
+
step_budget_mode: auto
|
| 57 |
+
eval_at_phase_end: false
|
| 58 |
+
save_at_phase_end: false
|
| 59 |
+
computed_plan: null
|
| 60 |
+
per_device_batch_size: 32
|
| 61 |
+
load_all_data_for_training: true
|
| 62 |
+
num_obs_frames: 4
|
| 63 |
+
image_mode: stitch
|
| 64 |
+
prompt_mode: raw
|
| 65 |
+
stitch_grid:
|
| 66 |
+
- 2
|
| 67 |
+
- 2
|
| 68 |
+
obs_image_size: null
|
| 69 |
+
video_backend: torchvision_av
|
| 70 |
+
dataset:
|
| 71 |
+
source_hf: ''
|
| 72 |
+
config_name: null
|
| 73 |
+
source_subdir: null
|
| 74 |
+
converted_name: flappy_train
|
| 75 |
+
single_source_hf: ''
|
| 76 |
+
mixed_source_hf: ''
|
| 77 |
+
single_converted_name: flappy_train
|
| 78 |
+
mixed_converted_name: flappy_mixed_latency_train
|
| 79 |
+
single_latency_filter: null
|
| 80 |
+
mixed_latency_filter: null
|
| 81 |
+
force_download: false
|
| 82 |
+
setup_force: false
|
| 83 |
+
skip_verification: false
|
| 84 |
+
verify_rows: 200
|
| 85 |
+
max_episodes: null
|
| 86 |
+
episodes_per_latency: null
|
| 87 |
+
latency_filter: null
|
| 88 |
+
debug_subset:
|
| 89 |
+
enabled: false
|
| 90 |
+
max_episodes: 5
|
| 91 |
+
suffix: debug
|
| 92 |
+
base_model:
|
| 93 |
+
repo_id: Qwen/Qwen3-VL-4B-Instruct
|
| 94 |
+
initialization:
|
| 95 |
+
checkpoint_local_dir: playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
|
| 96 |
+
checkpoint_hf_repo_id: StarVLA/Qwen3VL-OFT-Bridge-RT-1
|
| 97 |
+
checkpoint_filename: checkpoints/steps_5000_pytorch_model.pt
|
| 98 |
+
trainer:
|
| 99 |
+
max_train_steps: 4000
|
| 100 |
+
num_warmup_steps: 100
|
| 101 |
+
save_interval: 500
|
| 102 |
+
eval_interval: 250
|
| 103 |
+
eval_num_batches: 50
|
| 104 |
+
per_latency_eval_num_batches: null
|
| 105 |
+
eval_action_classification: false
|
| 106 |
+
eval_action_classification_interval: null
|
| 107 |
+
cc_f1_tolerance: 1
|
| 108 |
+
learning_rate:
|
| 109 |
+
base: 2.0e-05
|
| 110 |
+
qwen_vl_interface: 1.0e-05
|
| 111 |
+
action_model: 0.0001
|
| 112 |
+
lr_scheduler_type: cosine_with_min_lr
|
| 113 |
+
scheduler_specific_kwargs:
|
| 114 |
+
min_lr: 1.0e-06
|
| 115 |
+
freeze_modules: ''
|
| 116 |
+
freeze_vit: false
|
| 117 |
+
freeze_tied_embedding: false
|
| 118 |
+
freeze_llm_layers: []
|
| 119 |
+
loss_scale:
|
| 120 |
+
vla: 1.0
|
| 121 |
+
vlm: 0.1
|
| 122 |
+
max_grad_norm: 1.0
|
| 123 |
+
weight_decay: 0.0
|
| 124 |
+
logging_frequency: 1
|
| 125 |
+
profile_timing:
|
| 126 |
+
enabled: false
|
| 127 |
+
log_interval: 10
|
| 128 |
+
gradient_clipping: 1.0
|
| 129 |
+
gradient_accumulation_steps: 2
|
| 130 |
+
distributed_backend: deepspeed
|
| 131 |
+
is_resume: false
|
| 132 |
+
pretrained_checkpoint: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
|
| 133 |
+
resume_step: 0
|
| 134 |
+
reload_modules: null
|
| 135 |
+
optimizer:
|
| 136 |
+
name: AdamW
|
| 137 |
+
betas:
|
| 138 |
+
- 0.9
|
| 139 |
+
- 0.95
|
| 140 |
+
eps: 1.0e-08
|
| 141 |
+
weight_decay: 1.0e-08
|
| 142 |
+
fused: true
|
| 143 |
+
save_format: pt
|
| 144 |
+
workspace_dir: WORKSPACE_DIR
|
| 145 |
+
run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
|
| 146 |
+
seed: 42
|
| 147 |
+
wandb_entity: saberrr-zju
|
| 148 |
+
wandb_project: starVLA_rl_games
|
| 149 |
+
auth:
|
| 150 |
+
env_file: null
|
| 151 |
+
hf_token_env: HF_TOKEN
|
| 152 |
+
wandb_api_key_env: WANDB_API_KEY
|
| 153 |
+
paths:
|
| 154 |
+
run_root_dir: results/Checkpoints
|
| 155 |
+
dataset_local_dir: data/flappy_fix_latency_2_200ep_7k2steps
|
| 156 |
+
dataset_cache_dir: null
|
| 157 |
+
base_model_dir: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 158 |
+
accelerate_config: starVLA/config/deepseeds/deepspeed_zero2.yaml
|
| 159 |
+
launch:
|
| 160 |
+
use_accelerate: true
|
| 161 |
+
gpus: null
|
| 162 |
+
num_processes: 1
|
| 163 |
+
dry_run: false
|
| 164 |
+
conda:
|
| 165 |
+
enabled: true
|
| 166 |
+
env_name: null
|
| 167 |
+
rl_games:
|
| 168 |
+
model_alias: openvla
|
| 169 |
+
env_eval:
|
| 170 |
+
image_size: 224
|
| 171 |
+
frameskip: 1
|
| 172 |
+
image_transform: raw_rgb
|
| 173 |
+
prompt_mode: raw
|
| 174 |
+
ghost_trail:
|
| 175 |
+
history_frames: 5
|
| 176 |
+
gamma: 1.3
|
| 177 |
+
min_alpha: 35
|
| 178 |
+
scroll_px_per_step: 4.0
|
| 179 |
+
ground_fraction: 0.22
|
| 180 |
+
seed: 42
|
| 181 |
+
fixed_episode_seeds: true
|
| 182 |
+
latency_seed_stride: 0
|
| 183 |
+
task_seed_stride: 0
|
| 184 |
+
task_description: ''
|
| 185 |
+
eval_parallel_envs: 5
|
| 186 |
+
enabled: true
|
| 187 |
+
eval_backend: latency_bench
|
| 188 |
+
distributed_mode: rank_sharded
|
| 189 |
+
vectorized:
|
| 190 |
+
enabled: false
|
| 191 |
+
batch_size: 1
|
| 192 |
+
latency:
|
| 193 |
+
prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
|
| 194 |
+
mode: single
|
| 195 |
+
values:
|
| 196 |
+
- 0
|
| 197 |
+
mid_train:
|
| 198 |
+
enabled: true
|
| 199 |
+
interval_steps: 250
|
| 200 |
+
latencies:
|
| 201 |
+
- 2
|
| 202 |
+
num_episodes: 20
|
| 203 |
+
max_steps_per_episode: 3600
|
| 204 |
+
post_train:
|
| 205 |
+
enabled: true
|
| 206 |
+
latencies:
|
| 207 |
+
- 2
|
| 208 |
+
num_episodes: 50
|
| 209 |
+
max_steps_per_episode: 3600
|
| 210 |
+
task: flappy
|
| 211 |
+
initialization_mode: bridge
|
| 212 |
+
action_carrier: bridge
|
| 213 |
+
model: openvla
|
| 214 |
+
env: flappy
|
| 215 |
+
init: bridge
|
| 216 |
+
bridge_base_model:
|
| 217 |
+
repo_id:
|
| 218 |
+
openvla: Qwen/Qwen3-VL-4B-Instruct
|
| 219 |
+
pi0: StarVLA/Qwen2.5-VL-3B-Instruct-Action
|
| 220 |
+
pi05: Qwen/Qwen3-VL-4B-Instruct
|
| 221 |
+
gr00t: Qwen/Qwen3-VL-4B-Instruct
|
| 222 |
+
local_dir:
|
| 223 |
+
openvla: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 224 |
+
pi0: playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
|
| 225 |
+
pi05: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 226 |
+
gr00t: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 227 |
+
mode: single
|
| 228 |
+
checkpoint:
|
| 229 |
+
load: none
|
| 230 |
+
hf_repo_id: null
|
| 231 |
+
save_best_model: false
|
| 232 |
+
save_final_model: true
|
| 233 |
+
save_pt_file: false
|
| 234 |
+
save_safetensors_file: true
|
| 235 |
+
local:
|
| 236 |
+
keep_last_n: 1
|
| 237 |
+
sync:
|
| 238 |
+
enabled: false
|
| 239 |
+
repo_id: null
|
| 240 |
+
keep_last_n: 0
|
| 241 |
+
sync_every_n_checkpoints: 1
|
| 242 |
+
resume_policy: local_latest
|
| 243 |
+
run_id: flappy_fix_latency_2_200ep_7k2steps_stitch
|
| 244 |
+
output_dir: null
|
| 245 |
+
config_yaml: null
|
| 246 |
+
is_debug: false
|
| 247 |
+
version_id: 0.21
|
flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/hydra.yaml
ADDED
|
@@ -0,0 +1,368 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
hydra:
|
| 2 |
+
run:
|
| 3 |
+
dir: ${run_root_dir}/${run_id}/hydra
|
| 4 |
+
sweep:
|
| 5 |
+
dir: multirun/${now:%Y-%m-%d}/${now:%H-%M-%S}
|
| 6 |
+
subdir: ${hydra.job.num}
|
| 7 |
+
launcher:
|
| 8 |
+
_target_: hydra._internal.core_plugins.basic_launcher.BasicLauncher
|
| 9 |
+
sweeper:
|
| 10 |
+
_target_: hydra._internal.core_plugins.basic_sweeper.BasicSweeper
|
| 11 |
+
max_batch_size: null
|
| 12 |
+
params: null
|
| 13 |
+
help:
|
| 14 |
+
app_name: ${hydra.job.name}
|
| 15 |
+
header: '${hydra.help.app_name} is powered by Hydra.
|
| 16 |
+
|
| 17 |
+
'
|
| 18 |
+
footer: 'Powered by Hydra (https://hydra.cc)
|
| 19 |
+
|
| 20 |
+
Use --hydra-help to view Hydra specific help
|
| 21 |
+
|
| 22 |
+
'
|
| 23 |
+
template: '${hydra.help.header}
|
| 24 |
+
|
| 25 |
+
== Configuration groups ==
|
| 26 |
+
|
| 27 |
+
Compose your configuration from those groups (group=option)
|
| 28 |
+
|
| 29 |
+
|
| 30 |
+
$APP_CONFIG_GROUPS
|
| 31 |
+
|
| 32 |
+
|
| 33 |
+
== Config ==
|
| 34 |
+
|
| 35 |
+
Override anything in the config (foo.bar=value)
|
| 36 |
+
|
| 37 |
+
|
| 38 |
+
$CONFIG
|
| 39 |
+
|
| 40 |
+
|
| 41 |
+
${hydra.help.footer}
|
| 42 |
+
|
| 43 |
+
'
|
| 44 |
+
hydra_help:
|
| 45 |
+
template: 'Hydra (${hydra.runtime.version})
|
| 46 |
+
|
| 47 |
+
See https://hydra.cc for more info.
|
| 48 |
+
|
| 49 |
+
|
| 50 |
+
== Flags ==
|
| 51 |
+
|
| 52 |
+
$FLAGS_HELP
|
| 53 |
+
|
| 54 |
+
|
| 55 |
+
== Configuration groups ==
|
| 56 |
+
|
| 57 |
+
Compose your configuration from those groups (For example, append hydra/job_logging=disabled
|
| 58 |
+
to command line)
|
| 59 |
+
|
| 60 |
+
|
| 61 |
+
$HYDRA_CONFIG_GROUPS
|
| 62 |
+
|
| 63 |
+
|
| 64 |
+
Use ''--cfg hydra'' to Show the Hydra config.
|
| 65 |
+
|
| 66 |
+
'
|
| 67 |
+
hydra_help: ???
|
| 68 |
+
hydra_logging:
|
| 69 |
+
version: 1
|
| 70 |
+
formatters:
|
| 71 |
+
simple:
|
| 72 |
+
format: '[%(asctime)s][HYDRA] %(message)s'
|
| 73 |
+
handlers:
|
| 74 |
+
console:
|
| 75 |
+
class: logging.StreamHandler
|
| 76 |
+
formatter: simple
|
| 77 |
+
stream: ext://sys.stdout
|
| 78 |
+
root:
|
| 79 |
+
level: INFO
|
| 80 |
+
handlers:
|
| 81 |
+
- console
|
| 82 |
+
loggers:
|
| 83 |
+
logging_example:
|
| 84 |
+
level: DEBUG
|
| 85 |
+
disable_existing_loggers: false
|
| 86 |
+
job_logging:
|
| 87 |
+
version: 1
|
| 88 |
+
formatters:
|
| 89 |
+
simple:
|
| 90 |
+
format: '[%(asctime)s][%(name)s][%(levelname)s] - %(message)s'
|
| 91 |
+
handlers:
|
| 92 |
+
console:
|
| 93 |
+
class: logging.StreamHandler
|
| 94 |
+
formatter: simple
|
| 95 |
+
stream: ext://sys.stdout
|
| 96 |
+
file:
|
| 97 |
+
class: logging.FileHandler
|
| 98 |
+
formatter: simple
|
| 99 |
+
filename: ${hydra.runtime.output_dir}/${hydra.job.name}.log
|
| 100 |
+
root:
|
| 101 |
+
level: INFO
|
| 102 |
+
handlers:
|
| 103 |
+
- console
|
| 104 |
+
- file
|
| 105 |
+
disable_existing_loggers: false
|
| 106 |
+
env: {}
|
| 107 |
+
mode: RUN
|
| 108 |
+
searchpath: []
|
| 109 |
+
callbacks: {}
|
| 110 |
+
output_subdir: .hydra
|
| 111 |
+
overrides:
|
| 112 |
+
hydra:
|
| 113 |
+
- hydra.mode=RUN
|
| 114 |
+
task:
|
| 115 |
+
- model=openvla
|
| 116 |
+
- env=flappy
|
| 117 |
+
- init=bridge
|
| 118 |
+
- mode=single
|
| 119 |
+
- ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 120 |
+
- ++framework.qwenvl.attn_implementation=flash_attention_2
|
| 121 |
+
- ++framework.qwenvl.flex_backend=triton
|
| 122 |
+
- ++framework.qwenvl.enable_gradient_checkpointing=true
|
| 123 |
+
- ++framework.action_model.state_dim=7
|
| 124 |
+
- ++framework.action_model.loss_type=discrete_ce
|
| 125 |
+
- ++framework.action_model.action_horizon=1
|
| 126 |
+
- ++framework.action_model.future_action_window_size=0
|
| 127 |
+
- ++framework.action_model.past_action_window_size=0
|
| 128 |
+
- ++framework.action_model.action_dim=7
|
| 129 |
+
- ++framework.action_model.action_env_dim=2
|
| 130 |
+
- ++framework.kv_memory.enabled=false
|
| 131 |
+
- ++framework.kv_memory.window=4
|
| 132 |
+
- ++framework.kv_memory.rollout_len=8
|
| 133 |
+
- ++framework.kv_memory.packed_train=false
|
| 134 |
+
- ++framework.kv_memory.rebased_sink=true
|
| 135 |
+
- ++framework.name=QwenOFT
|
| 136 |
+
- ++datasets.vla_data.dataset_py=lerobot_datasets
|
| 137 |
+
- ++datasets.vla_data.include_state=true
|
| 138 |
+
- ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
|
| 139 |
+
- ++datasets.vla_data.data_mix=flappy_train
|
| 140 |
+
- ++datasets.vla_data.eval_data_mix=null
|
| 141 |
+
- ++datasets.vla_data.custom_mixtures_path=null
|
| 142 |
+
- ++datasets.vla_data.action_type=discrete
|
| 143 |
+
- ++datasets.vla_data.sequential_step_sampling=false
|
| 144 |
+
- ++datasets.vla_data.eval_sequential_step_sampling=null
|
| 145 |
+
- ++datasets.vla_data.num_workers=8
|
| 146 |
+
- ++datasets.vla_data.eval_num_workers=8
|
| 147 |
+
- ++datasets.vla_data.prefetch_factor=4
|
| 148 |
+
- ++datasets.vla_data.persistent_workers=true
|
| 149 |
+
- ++datasets.vla_data.pin_memory=true
|
| 150 |
+
- ++datasets.vla_data.shuffle=true
|
| 151 |
+
- ++datasets.vla_data.action_balance.enabled=false
|
| 152 |
+
- ++datasets.vla_data.action_balance.strategy=balanced_epoch
|
| 153 |
+
- ++datasets.vla_data.action_balance.action_key=action_id
|
| 154 |
+
- ++datasets.vla_data.action_balance.target_flap_fraction=0.3
|
| 155 |
+
- ++datasets.vla_data.action_balance.noop_id=0
|
| 156 |
+
- ++datasets.vla_data.action_balance.flap_id=1
|
| 157 |
+
- ++datasets.vla_data.latency_curriculum.enabled=false
|
| 158 |
+
- ++datasets.vla_data.latency_curriculum.strategy=exclusive
|
| 159 |
+
- ++datasets.vla_data.latency_curriculum.latencies=null
|
| 160 |
+
- ++datasets.vla_data.latency_curriculum.phase_steps=null
|
| 161 |
+
- ++datasets.vla_data.latency_curriculum.phase_distributions=null
|
| 162 |
+
- ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
|
| 163 |
+
- ++datasets.vla_data.latency_curriculum.replay_passes=0.25
|
| 164 |
+
- ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
|
| 165 |
+
- ++datasets.vla_data.latency_curriculum.final_equalization=true
|
| 166 |
+
- ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
|
| 167 |
+
- ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
|
| 168 |
+
- ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
|
| 169 |
+
- ++datasets.vla_data.latency_curriculum.computed_plan=null
|
| 170 |
+
- ++datasets.vla_data.per_device_batch_size=32
|
| 171 |
+
- ++datasets.vla_data.load_all_data_for_training=true
|
| 172 |
+
- ++datasets.vla_data.num_obs_frames=4
|
| 173 |
+
- ++datasets.vla_data.image_mode=stitch
|
| 174 |
+
- ++datasets.vla_data.prompt_mode=raw
|
| 175 |
+
- ++datasets.vla_data.stitch_grid=[2,2]
|
| 176 |
+
- ++datasets.vla_data.obs_image_size=null
|
| 177 |
+
- ++datasets.vla_data.video_backend=torchvision_av
|
| 178 |
+
- ++dataset.source_hf=
|
| 179 |
+
- ++dataset.config_name=null
|
| 180 |
+
- ++dataset.source_subdir=null
|
| 181 |
+
- ++dataset.converted_name=flappy_train
|
| 182 |
+
- ++dataset.single_source_hf=
|
| 183 |
+
- ++dataset.mixed_source_hf=
|
| 184 |
+
- ++dataset.single_converted_name=flappy_train
|
| 185 |
+
- ++dataset.mixed_converted_name=flappy_mixed_latency_train
|
| 186 |
+
- ++dataset.single_latency_filter=null
|
| 187 |
+
- ++dataset.mixed_latency_filter=null
|
| 188 |
+
- ++dataset.force_download=false
|
| 189 |
+
- ++dataset.setup_force=false
|
| 190 |
+
- ++dataset.skip_verification=false
|
| 191 |
+
- ++dataset.verify_rows=200
|
| 192 |
+
- ++dataset.max_episodes=null
|
| 193 |
+
- ++dataset.episodes_per_latency=null
|
| 194 |
+
- ++dataset.latency_filter=null
|
| 195 |
+
- ++dataset.debug_subset.enabled=false
|
| 196 |
+
- ++dataset.debug_subset.max_episodes=5
|
| 197 |
+
- ++dataset.debug_subset.suffix=debug
|
| 198 |
+
- ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
|
| 199 |
+
- ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
|
| 200 |
+
- ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
|
| 201 |
+
- ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
|
| 202 |
+
- trainer.max_train_steps=4000
|
| 203 |
+
- trainer.num_warmup_steps=100
|
| 204 |
+
- trainer.save_interval=500
|
| 205 |
+
- trainer.eval_interval=250
|
| 206 |
+
- trainer.eval_num_batches=50
|
| 207 |
+
- trainer.per_latency_eval_num_batches=null
|
| 208 |
+
- trainer.eval_action_classification=false
|
| 209 |
+
- trainer.eval_action_classification_interval=null
|
| 210 |
+
- trainer.cc_f1_tolerance=1
|
| 211 |
+
- trainer.learning_rate.base=2e-05
|
| 212 |
+
- trainer.learning_rate.qwen_vl_interface=1e-05
|
| 213 |
+
- trainer.learning_rate.action_model=0.0001
|
| 214 |
+
- trainer.lr_scheduler_type=cosine_with_min_lr
|
| 215 |
+
- trainer.scheduler_specific_kwargs.min_lr=1e-06
|
| 216 |
+
- trainer.freeze_modules=
|
| 217 |
+
- trainer.freeze_vit=false
|
| 218 |
+
- trainer.freeze_tied_embedding=false
|
| 219 |
+
- trainer.freeze_llm_layers=[]
|
| 220 |
+
- trainer.loss_scale.vla=1.0
|
| 221 |
+
- trainer.loss_scale.vlm=0.1
|
| 222 |
+
- trainer.max_grad_norm=1.0
|
| 223 |
+
- trainer.weight_decay=0.0
|
| 224 |
+
- trainer.logging_frequency=1
|
| 225 |
+
- trainer.profile_timing.enabled=false
|
| 226 |
+
- trainer.profile_timing.log_interval=10
|
| 227 |
+
- trainer.gradient_clipping=1.0
|
| 228 |
+
- trainer.gradient_accumulation_steps=2
|
| 229 |
+
- trainer.distributed_backend=deepspeed
|
| 230 |
+
- trainer.is_resume=false
|
| 231 |
+
- trainer.pretrained_checkpoint=null
|
| 232 |
+
- trainer.resume_step=0
|
| 233 |
+
- trainer.reload_modules=null
|
| 234 |
+
- trainer.optimizer.name=AdamW
|
| 235 |
+
- trainer.optimizer.betas=[0.9,0.95]
|
| 236 |
+
- trainer.optimizer.eps=1e-08
|
| 237 |
+
- trainer.optimizer.weight_decay=1e-08
|
| 238 |
+
- trainer.optimizer.fused=true
|
| 239 |
+
- trainer.save_format=pt
|
| 240 |
+
- ++workspace_dir=WORKSPACE_DIR
|
| 241 |
+
- ++run_root_dir=results/Checkpoints
|
| 242 |
+
- ++seed=42
|
| 243 |
+
- ++wandb_entity=saberrr-zju
|
| 244 |
+
- ++wandb_project=starVLA_rl_games
|
| 245 |
+
- ++auth.env_file=null
|
| 246 |
+
- ++auth.hf_token_env=HF_TOKEN
|
| 247 |
+
- ++auth.wandb_api_key_env=WANDB_API_KEY
|
| 248 |
+
- ++paths.run_root_dir=results/Checkpoints
|
| 249 |
+
- ++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps
|
| 250 |
+
- ++paths.dataset_cache_dir=null
|
| 251 |
+
- ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 252 |
+
- ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
|
| 253 |
+
- ++rl_games.model_alias=openvla
|
| 254 |
+
- ++rl_games.env_eval.image_size=224
|
| 255 |
+
- ++rl_games.env_eval.frameskip=1
|
| 256 |
+
- ++rl_games.env_eval.image_transform=raw_rgb
|
| 257 |
+
- ++rl_games.env_eval.prompt_mode=raw
|
| 258 |
+
- ++rl_games.env_eval.ghost_trail.history_frames=5
|
| 259 |
+
- ++rl_games.env_eval.ghost_trail.gamma=1.3
|
| 260 |
+
- ++rl_games.env_eval.ghost_trail.min_alpha=35
|
| 261 |
+
- ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
|
| 262 |
+
- ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
|
| 263 |
+
- ++rl_games.env_eval.seed=42
|
| 264 |
+
- ++rl_games.env_eval.fixed_episode_seeds=true
|
| 265 |
+
- ++rl_games.env_eval.latency_seed_stride=0
|
| 266 |
+
- ++rl_games.env_eval.task_seed_stride=0
|
| 267 |
+
- ++rl_games.env_eval.task_description=
|
| 268 |
+
- ++rl_games.env_eval.eval_parallel_envs=5
|
| 269 |
+
- ++rl_games.env_eval.enabled=true
|
| 270 |
+
- ++rl_games.env_eval.eval_backend=latency_bench
|
| 271 |
+
- ++rl_games.env_eval.distributed_mode=rank_sharded
|
| 272 |
+
- ++rl_games.env_eval.vectorized.enabled=false
|
| 273 |
+
- ++rl_games.env_eval.vectorized.batch_size=1
|
| 274 |
+
- ++rl_games.env_eval.latency.prompt_map_path=null
|
| 275 |
+
- ++rl_games.env_eval.latency.mode=single
|
| 276 |
+
- ++rl_games.env_eval.latency.values=[0]
|
| 277 |
+
- ++rl_games.env_eval.mid_train.enabled=true
|
| 278 |
+
- ++rl_games.env_eval.mid_train.interval_steps=250
|
| 279 |
+
- ++rl_games.env_eval.mid_train.latencies=[2]
|
| 280 |
+
- ++rl_games.env_eval.mid_train.num_episodes=20
|
| 281 |
+
- ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
|
| 282 |
+
- ++rl_games.env_eval.post_train.enabled=true
|
| 283 |
+
- ++rl_games.env_eval.post_train.latencies=[2]
|
| 284 |
+
- ++rl_games.env_eval.post_train.num_episodes=50
|
| 285 |
+
- ++rl_games.env_eval.post_train.max_steps_per_episode=3600
|
| 286 |
+
- ++rl_games.task=flappy
|
| 287 |
+
- ++rl_games.initialization_mode=bridge
|
| 288 |
+
- ++rl_games.action_carrier=bridge
|
| 289 |
+
- ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
|
| 290 |
+
- ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
|
| 291 |
+
- ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
|
| 292 |
+
- ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
|
| 293 |
+
- ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 294 |
+
- ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
|
| 295 |
+
- ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 296 |
+
- ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 297 |
+
- ++checkpoint.load=none
|
| 298 |
+
- ++checkpoint.hf_repo_id=null
|
| 299 |
+
- ++checkpoint.save_best_model=false
|
| 300 |
+
- ++checkpoint.save_final_model=true
|
| 301 |
+
- ++checkpoint.save_pt_file=false
|
| 302 |
+
- ++checkpoint.save_safetensors_file=true
|
| 303 |
+
- ++checkpoint.local.keep_last_n=1
|
| 304 |
+
- ++checkpoint.sync.enabled=false
|
| 305 |
+
- ++checkpoint.sync.repo_id=null
|
| 306 |
+
- ++checkpoint.sync.keep_last_n=0
|
| 307 |
+
- ++checkpoint.sync.sync_every_n_checkpoints=1
|
| 308 |
+
- ++checkpoint.sync.resume_policy=local_latest
|
| 309 |
+
- ++run_id=flappy_fix_latency_2_200ep_7k2steps_stitch
|
| 310 |
+
- ++output_dir=null
|
| 311 |
+
- ++config_yaml=null
|
| 312 |
+
- ++is_debug=false
|
| 313 |
+
- ++version_id=0.21
|
| 314 |
+
- ++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints
|
| 315 |
+
- trainer.is_resume=false
|
| 316 |
+
- trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
|
| 317 |
+
- trainer.resume_step=0
|
| 318 |
+
- ++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
|
| 319 |
+
- ++datasets.vla_data.data_mix=flappy_train__bridge
|
| 320 |
+
- ++datasets.vla_data.eval_data_mix=flappy_train__bridge__val
|
| 321 |
+
- ++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 322 |
+
- ++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
|
| 323 |
+
job:
|
| 324 |
+
name: train_starvla_hydra
|
| 325 |
+
chdir: false
|
| 326 |
+
override_dirname: ++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=none,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=flappy_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=flappy_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=flappy_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=flappy_train,++datasets.vla_data.data_mix=flappy_train__bridge,++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=flappy_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=stitch,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=4,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=32,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=2,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++framework.qwenvl.flex_backend=triton,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=1,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=true,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=true,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description=,++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=flappy,++run_id=flappy_fix_latency_2_200ep_7k2steps_stitch,++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++version_id=0.21,++wandb_entity=saberrr-zju,++wandb_project=starVLA_rl_games,++workspace_dir=WORKSPACE_DIR,env=flappy,init=bridge,mode=single,model=openvla,trainer.cc_f1_tolerance=1,trainer.distributed_backend=deepspeed,trainer.eval_action_classification=false,trainer.eval_action_classification_interval=null,trainer.eval_interval=250,trainer.eval_num_batches=50,trainer.freeze_llm_layers=[],trainer.freeze_modules=,trainer.freeze_tied_embedding=false,trainer.freeze_vit=false,trainer.gradient_accumulation_steps=2,trainer.gradient_clipping=1.0,trainer.is_resume=false,trainer.is_resume=false,trainer.learning_rate.action_model=0.0001,trainer.learning_rate.base=2e-05,trainer.learning_rate.qwen_vl_interface=1e-05,trainer.logging_frequency=1,trainer.loss_scale.vla=1.0,trainer.loss_scale.vlm=0.1,trainer.lr_scheduler_type=cosine_with_min_lr,trainer.max_grad_norm=1.0,trainer.max_train_steps=4000,trainer.num_warmup_steps=100,trainer.optimizer.betas=[0.9,0.95],trainer.optimizer.eps=1e-08,trainer.optimizer.fused=true,trainer.optimizer.name=AdamW,trainer.optimizer.weight_decay=1e-08,trainer.per_latency_eval_num_batches=null,trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt,trainer.pretrained_checkpoint=null,trainer.profile_timing.enabled=false,trainer.profile_timing.log_interval=10,trainer.reload_modules=null,trainer.resume_step=0,trainer.resume_step=0,trainer.save_format=pt,trainer.save_interval=500,trainer.scheduler_specific_kwargs.min_lr=1e-06,trainer.weight_decay=0.0
|
| 327 |
+
id: ???
|
| 328 |
+
num: ???
|
| 329 |
+
config_name: train
|
| 330 |
+
env_set: {}
|
| 331 |
+
env_copy: []
|
| 332 |
+
config:
|
| 333 |
+
override_dirname:
|
| 334 |
+
kv_sep: '='
|
| 335 |
+
item_sep: ','
|
| 336 |
+
exclude_keys: []
|
| 337 |
+
runtime:
|
| 338 |
+
version: 1.3.3
|
| 339 |
+
version_base: '1.1'
|
| 340 |
+
cwd: /workspace/latency-sensitive-bench/starVLA
|
| 341 |
+
config_sources:
|
| 342 |
+
- path: hydra.conf
|
| 343 |
+
schema: pkg
|
| 344 |
+
provider: hydra
|
| 345 |
+
- path: /workspace/latency-sensitive-bench/starVLA/examples/rl_games/config
|
| 346 |
+
schema: file
|
| 347 |
+
provider: main
|
| 348 |
+
- path: ''
|
| 349 |
+
schema: structured
|
| 350 |
+
provider: schema
|
| 351 |
+
output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/hydra
|
| 352 |
+
choices:
|
| 353 |
+
cross_task_setup: null
|
| 354 |
+
checkpoint: default
|
| 355 |
+
mode: single
|
| 356 |
+
init: bridge
|
| 357 |
+
env: flappy
|
| 358 |
+
model: openvla
|
| 359 |
+
hydra/env: default
|
| 360 |
+
hydra/callbacks: null
|
| 361 |
+
hydra/job_logging: default
|
| 362 |
+
hydra/hydra_logging: default
|
| 363 |
+
hydra/hydra_help: default
|
| 364 |
+
hydra/help: default
|
| 365 |
+
hydra/sweeper: basic
|
| 366 |
+
hydra/launcher: basic
|
| 367 |
+
hydra/output: default
|
| 368 |
+
verbose: false
|
flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/.hydra/overrides.yaml
ADDED
|
@@ -0,0 +1,208 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
- model=openvla
|
| 2 |
+
- env=flappy
|
| 3 |
+
- init=bridge
|
| 4 |
+
- mode=single
|
| 5 |
+
- ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 6 |
+
- ++framework.qwenvl.attn_implementation=flash_attention_2
|
| 7 |
+
- ++framework.qwenvl.flex_backend=triton
|
| 8 |
+
- ++framework.qwenvl.enable_gradient_checkpointing=true
|
| 9 |
+
- ++framework.action_model.state_dim=7
|
| 10 |
+
- ++framework.action_model.loss_type=discrete_ce
|
| 11 |
+
- ++framework.action_model.action_horizon=1
|
| 12 |
+
- ++framework.action_model.future_action_window_size=0
|
| 13 |
+
- ++framework.action_model.past_action_window_size=0
|
| 14 |
+
- ++framework.action_model.action_dim=7
|
| 15 |
+
- ++framework.action_model.action_env_dim=2
|
| 16 |
+
- ++framework.kv_memory.enabled=false
|
| 17 |
+
- ++framework.kv_memory.window=4
|
| 18 |
+
- ++framework.kv_memory.rollout_len=8
|
| 19 |
+
- ++framework.kv_memory.packed_train=false
|
| 20 |
+
- ++framework.kv_memory.rebased_sink=true
|
| 21 |
+
- ++framework.name=QwenOFT
|
| 22 |
+
- ++datasets.vla_data.dataset_py=lerobot_datasets
|
| 23 |
+
- ++datasets.vla_data.include_state=true
|
| 24 |
+
- ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
|
| 25 |
+
- ++datasets.vla_data.data_mix=flappy_train
|
| 26 |
+
- ++datasets.vla_data.eval_data_mix=null
|
| 27 |
+
- ++datasets.vla_data.custom_mixtures_path=null
|
| 28 |
+
- ++datasets.vla_data.action_type=discrete
|
| 29 |
+
- ++datasets.vla_data.sequential_step_sampling=false
|
| 30 |
+
- ++datasets.vla_data.eval_sequential_step_sampling=null
|
| 31 |
+
- ++datasets.vla_data.num_workers=8
|
| 32 |
+
- ++datasets.vla_data.eval_num_workers=8
|
| 33 |
+
- ++datasets.vla_data.prefetch_factor=4
|
| 34 |
+
- ++datasets.vla_data.persistent_workers=true
|
| 35 |
+
- ++datasets.vla_data.pin_memory=true
|
| 36 |
+
- ++datasets.vla_data.shuffle=true
|
| 37 |
+
- ++datasets.vla_data.action_balance.enabled=false
|
| 38 |
+
- ++datasets.vla_data.action_balance.strategy=balanced_epoch
|
| 39 |
+
- ++datasets.vla_data.action_balance.action_key=action_id
|
| 40 |
+
- ++datasets.vla_data.action_balance.target_flap_fraction=0.3
|
| 41 |
+
- ++datasets.vla_data.action_balance.noop_id=0
|
| 42 |
+
- ++datasets.vla_data.action_balance.flap_id=1
|
| 43 |
+
- ++datasets.vla_data.latency_curriculum.enabled=false
|
| 44 |
+
- ++datasets.vla_data.latency_curriculum.strategy=exclusive
|
| 45 |
+
- ++datasets.vla_data.latency_curriculum.latencies=null
|
| 46 |
+
- ++datasets.vla_data.latency_curriculum.phase_steps=null
|
| 47 |
+
- ++datasets.vla_data.latency_curriculum.phase_distributions=null
|
| 48 |
+
- ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
|
| 49 |
+
- ++datasets.vla_data.latency_curriculum.replay_passes=0.25
|
| 50 |
+
- ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
|
| 51 |
+
- ++datasets.vla_data.latency_curriculum.final_equalization=true
|
| 52 |
+
- ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
|
| 53 |
+
- ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
|
| 54 |
+
- ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
|
| 55 |
+
- ++datasets.vla_data.latency_curriculum.computed_plan=null
|
| 56 |
+
- ++datasets.vla_data.per_device_batch_size=32
|
| 57 |
+
- ++datasets.vla_data.load_all_data_for_training=true
|
| 58 |
+
- ++datasets.vla_data.num_obs_frames=4
|
| 59 |
+
- ++datasets.vla_data.image_mode=stitch
|
| 60 |
+
- ++datasets.vla_data.prompt_mode=raw
|
| 61 |
+
- ++datasets.vla_data.stitch_grid=[2,2]
|
| 62 |
+
- ++datasets.vla_data.obs_image_size=null
|
| 63 |
+
- ++datasets.vla_data.video_backend=torchvision_av
|
| 64 |
+
- ++dataset.source_hf=
|
| 65 |
+
- ++dataset.config_name=null
|
| 66 |
+
- ++dataset.source_subdir=null
|
| 67 |
+
- ++dataset.converted_name=flappy_train
|
| 68 |
+
- ++dataset.single_source_hf=
|
| 69 |
+
- ++dataset.mixed_source_hf=
|
| 70 |
+
- ++dataset.single_converted_name=flappy_train
|
| 71 |
+
- ++dataset.mixed_converted_name=flappy_mixed_latency_train
|
| 72 |
+
- ++dataset.single_latency_filter=null
|
| 73 |
+
- ++dataset.mixed_latency_filter=null
|
| 74 |
+
- ++dataset.force_download=false
|
| 75 |
+
- ++dataset.setup_force=false
|
| 76 |
+
- ++dataset.skip_verification=false
|
| 77 |
+
- ++dataset.verify_rows=200
|
| 78 |
+
- ++dataset.max_episodes=null
|
| 79 |
+
- ++dataset.episodes_per_latency=null
|
| 80 |
+
- ++dataset.latency_filter=null
|
| 81 |
+
- ++dataset.debug_subset.enabled=false
|
| 82 |
+
- ++dataset.debug_subset.max_episodes=5
|
| 83 |
+
- ++dataset.debug_subset.suffix=debug
|
| 84 |
+
- ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
|
| 85 |
+
- ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
|
| 86 |
+
- ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
|
| 87 |
+
- ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
|
| 88 |
+
- trainer.max_train_steps=4000
|
| 89 |
+
- trainer.num_warmup_steps=100
|
| 90 |
+
- trainer.save_interval=500
|
| 91 |
+
- trainer.eval_interval=250
|
| 92 |
+
- trainer.eval_num_batches=50
|
| 93 |
+
- trainer.per_latency_eval_num_batches=null
|
| 94 |
+
- trainer.eval_action_classification=false
|
| 95 |
+
- trainer.eval_action_classification_interval=null
|
| 96 |
+
- trainer.cc_f1_tolerance=1
|
| 97 |
+
- trainer.learning_rate.base=2e-05
|
| 98 |
+
- trainer.learning_rate.qwen_vl_interface=1e-05
|
| 99 |
+
- trainer.learning_rate.action_model=0.0001
|
| 100 |
+
- trainer.lr_scheduler_type=cosine_with_min_lr
|
| 101 |
+
- trainer.scheduler_specific_kwargs.min_lr=1e-06
|
| 102 |
+
- trainer.freeze_modules=
|
| 103 |
+
- trainer.freeze_vit=false
|
| 104 |
+
- trainer.freeze_tied_embedding=false
|
| 105 |
+
- trainer.freeze_llm_layers=[]
|
| 106 |
+
- trainer.loss_scale.vla=1.0
|
| 107 |
+
- trainer.loss_scale.vlm=0.1
|
| 108 |
+
- trainer.max_grad_norm=1.0
|
| 109 |
+
- trainer.weight_decay=0.0
|
| 110 |
+
- trainer.logging_frequency=1
|
| 111 |
+
- trainer.profile_timing.enabled=false
|
| 112 |
+
- trainer.profile_timing.log_interval=10
|
| 113 |
+
- trainer.gradient_clipping=1.0
|
| 114 |
+
- trainer.gradient_accumulation_steps=2
|
| 115 |
+
- trainer.distributed_backend=deepspeed
|
| 116 |
+
- trainer.is_resume=false
|
| 117 |
+
- trainer.pretrained_checkpoint=null
|
| 118 |
+
- trainer.resume_step=0
|
| 119 |
+
- trainer.reload_modules=null
|
| 120 |
+
- trainer.optimizer.name=AdamW
|
| 121 |
+
- trainer.optimizer.betas=[0.9,0.95]
|
| 122 |
+
- trainer.optimizer.eps=1e-08
|
| 123 |
+
- trainer.optimizer.weight_decay=1e-08
|
| 124 |
+
- trainer.optimizer.fused=true
|
| 125 |
+
- trainer.save_format=pt
|
| 126 |
+
- ++workspace_dir=WORKSPACE_DIR
|
| 127 |
+
- ++run_root_dir=results/Checkpoints
|
| 128 |
+
- ++seed=42
|
| 129 |
+
- ++wandb_entity=saberrr-zju
|
| 130 |
+
- ++wandb_project=starVLA_rl_games
|
| 131 |
+
- ++auth.env_file=null
|
| 132 |
+
- ++auth.hf_token_env=HF_TOKEN
|
| 133 |
+
- ++auth.wandb_api_key_env=WANDB_API_KEY
|
| 134 |
+
- ++paths.run_root_dir=results/Checkpoints
|
| 135 |
+
- ++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps
|
| 136 |
+
- ++paths.dataset_cache_dir=null
|
| 137 |
+
- ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 138 |
+
- ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
|
| 139 |
+
- ++rl_games.model_alias=openvla
|
| 140 |
+
- ++rl_games.env_eval.image_size=224
|
| 141 |
+
- ++rl_games.env_eval.frameskip=1
|
| 142 |
+
- ++rl_games.env_eval.image_transform=raw_rgb
|
| 143 |
+
- ++rl_games.env_eval.prompt_mode=raw
|
| 144 |
+
- ++rl_games.env_eval.ghost_trail.history_frames=5
|
| 145 |
+
- ++rl_games.env_eval.ghost_trail.gamma=1.3
|
| 146 |
+
- ++rl_games.env_eval.ghost_trail.min_alpha=35
|
| 147 |
+
- ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
|
| 148 |
+
- ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
|
| 149 |
+
- ++rl_games.env_eval.seed=42
|
| 150 |
+
- ++rl_games.env_eval.fixed_episode_seeds=true
|
| 151 |
+
- ++rl_games.env_eval.latency_seed_stride=0
|
| 152 |
+
- ++rl_games.env_eval.task_seed_stride=0
|
| 153 |
+
- ++rl_games.env_eval.task_description=
|
| 154 |
+
- ++rl_games.env_eval.eval_parallel_envs=5
|
| 155 |
+
- ++rl_games.env_eval.enabled=true
|
| 156 |
+
- ++rl_games.env_eval.eval_backend=latency_bench
|
| 157 |
+
- ++rl_games.env_eval.distributed_mode=rank_sharded
|
| 158 |
+
- ++rl_games.env_eval.vectorized.enabled=false
|
| 159 |
+
- ++rl_games.env_eval.vectorized.batch_size=1
|
| 160 |
+
- ++rl_games.env_eval.latency.prompt_map_path=null
|
| 161 |
+
- ++rl_games.env_eval.latency.mode=single
|
| 162 |
+
- ++rl_games.env_eval.latency.values=[0]
|
| 163 |
+
- ++rl_games.env_eval.mid_train.enabled=true
|
| 164 |
+
- ++rl_games.env_eval.mid_train.interval_steps=250
|
| 165 |
+
- ++rl_games.env_eval.mid_train.latencies=[2]
|
| 166 |
+
- ++rl_games.env_eval.mid_train.num_episodes=20
|
| 167 |
+
- ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
|
| 168 |
+
- ++rl_games.env_eval.post_train.enabled=true
|
| 169 |
+
- ++rl_games.env_eval.post_train.latencies=[2]
|
| 170 |
+
- ++rl_games.env_eval.post_train.num_episodes=50
|
| 171 |
+
- ++rl_games.env_eval.post_train.max_steps_per_episode=3600
|
| 172 |
+
- ++rl_games.task=flappy
|
| 173 |
+
- ++rl_games.initialization_mode=bridge
|
| 174 |
+
- ++rl_games.action_carrier=bridge
|
| 175 |
+
- ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
|
| 176 |
+
- ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
|
| 177 |
+
- ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
|
| 178 |
+
- ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
|
| 179 |
+
- ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 180 |
+
- ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
|
| 181 |
+
- ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 182 |
+
- ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 183 |
+
- ++checkpoint.load=none
|
| 184 |
+
- ++checkpoint.hf_repo_id=null
|
| 185 |
+
- ++checkpoint.save_best_model=false
|
| 186 |
+
- ++checkpoint.save_final_model=true
|
| 187 |
+
- ++checkpoint.save_pt_file=false
|
| 188 |
+
- ++checkpoint.save_safetensors_file=true
|
| 189 |
+
- ++checkpoint.local.keep_last_n=1
|
| 190 |
+
- ++checkpoint.sync.enabled=false
|
| 191 |
+
- ++checkpoint.sync.repo_id=null
|
| 192 |
+
- ++checkpoint.sync.keep_last_n=0
|
| 193 |
+
- ++checkpoint.sync.sync_every_n_checkpoints=1
|
| 194 |
+
- ++checkpoint.sync.resume_policy=local_latest
|
| 195 |
+
- ++run_id=flappy_fix_latency_2_200ep_7k2steps_stitch
|
| 196 |
+
- ++output_dir=null
|
| 197 |
+
- ++config_yaml=null
|
| 198 |
+
- ++is_debug=false
|
| 199 |
+
- ++version_id=0.21
|
| 200 |
+
- ++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints
|
| 201 |
+
- trainer.is_resume=false
|
| 202 |
+
- trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
|
| 203 |
+
- trainer.resume_step=0
|
| 204 |
+
- ++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
|
| 205 |
+
- ++datasets.vla_data.data_mix=flappy_train__bridge
|
| 206 |
+
- ++datasets.vla_data.eval_data_mix=flappy_train__bridge__val
|
| 207 |
+
- ++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 208 |
+
- ++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
|
flappy_fix_latency_2_200ep_7k2steps_stitch/hydra/train_starvla_hydra.log
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 0, "episode_return": 6.500000096857548, "episode_return_env": 6.500000096857548, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 67, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 67}
|
| 2 |
+
{"episode_id": 2, "episode_return": 174.80000206828117, "episode_return_env": 174.80000206828117, "game_score": 37.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1426, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1426}
|
| 3 |
+
{"episode_id": 4, "episode_return": 127.50000151246786, "episode_return_env": 127.50000151246786, "game_score": 27.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1043, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1043}
|
| 4 |
+
{"episode_id": 6, "episode_return": 288.4000034034252, "episode_return_env": 288.4000034034252, "game_score": 61.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2346, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2346}
|
| 5 |
+
{"episode_id": 8, "episode_return": 6.70000009983778, "episode_return_env": 6.70000009983778, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 69, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 69}
|
| 6 |
+
{"episode_id": 10, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
|
| 7 |
+
{"episode_id": 12, "episode_return": 138.90000165253878, "episode_return_env": 138.90000165253878, "game_score": 29.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1139, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1139}
|
| 8 |
+
{"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 9 |
+
{"episode_id": 16, "episode_return": 249.00000293552876, "episode_return_env": 249.00000293552876, "game_score": 53.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2024, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2024}
|
| 10 |
+
{"episode_id": 18, "episode_return": 190.4000022560358, "episode_return_env": 190.4000022560358, "game_score": 40.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1555, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1555}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 1, "episode_return": 113.50000134855509, "episode_return_env": 113.50000134855509, "game_score": 24.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 930, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 930}
|
| 2 |
+
{"episode_id": 3, "episode_return": 393.50000462681055, "episode_return_env": 393.50000462681055, "game_score": 84.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3190, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3190}
|
| 3 |
+
{"episode_id": 5, "episode_return": 46.800000578165054, "episode_return_env": 46.800000578165054, "game_score": 9.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 398, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 398}
|
| 4 |
+
{"episode_id": 7, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 5 |
+
{"episode_id": 9, "episode_return": 342.5000040307641, "episode_return_env": 342.5000040307641, "game_score": 73.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2779, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2779}
|
| 6 |
+
{"episode_id": 11, "episode_return": 37.300000466406345, "episode_return_env": 37.300000466406345, "game_score": 7.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 321, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 321}
|
| 7 |
+
{"episode_id": 13, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 8 |
+
{"episode_id": 15, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 9 |
+
{"episode_id": 17, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 10 |
+
{"episode_id": 19, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 1, "episode_return": 113.50000134855509, "episode_return_env": 113.50000134855509, "game_score": 24.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 930, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 930}
|
| 2 |
+
{"episode_id": 3, "episode_return": 67.0000008046627, "episode_return_env": 67.0000008046627, "game_score": 14.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 555, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 555}
|
| 3 |
+
{"episode_id": 5, "episode_return": 244.5000028833747, "episode_return_env": 244.5000028833747, "game_score": 52.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1988, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1988}
|
| 4 |
+
{"episode_id": 7, "episode_return": 155.5000018402934, "episode_return_env": 155.5000018402934, "game_score": 33.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1269, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1269}
|
| 5 |
+
{"episode_id": 9, "episode_return": 6.800000101327896, "episode_return_env": 6.800000101327896, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 70, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 70}
|
| 6 |
+
{"episode_id": 11, "episode_return": 85.50000102072954, "episode_return_env": 85.50000102072954, "game_score": 18.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 704, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 704}
|
| 7 |
+
{"episode_id": 13, "episode_return": 333.1000039204955, "episode_return_env": 333.1000039204955, "game_score": 71.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2703, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2703}
|
| 8 |
+
{"episode_id": 15, "episode_return": 43.80000053346157, "episode_return_env": 43.80000053346157, "game_score": 9.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 368, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 368}
|
| 9 |
+
{"episode_id": 17, "episode_return": 291.0000034272671, "episode_return_env": 291.0000034272671, "game_score": 62.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2363, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2363}
|
| 10 |
+
{"episode_id": 19, "episode_return": 6.800000101327896, "episode_return_env": 6.800000101327896, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 70, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 70}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 1, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 2 |
+
{"episode_id": 3, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 3 |
+
{"episode_id": 5, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 4 |
+
{"episode_id": 7, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 5 |
+
{"episode_id": 9, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 6 |
+
{"episode_id": 11, "episode_return": 272.50000321120024, "episode_return_env": 272.50000321120024, "game_score": 58.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2214, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2214}
|
| 7 |
+
{"episode_id": 13, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 8 |
+
{"episode_id": 15, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 9 |
+
{"episode_id": 17, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 10 |
+
{"episode_id": 19, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 2 |
+
{"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 3 |
+
{"episode_id": 4, "episode_return": 440.80000518262386, "episode_return_env": 440.80000518262386, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3573, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3573}
|
| 4 |
+
{"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 5 |
+
{"episode_id": 8, "episode_return": 180.9000021442771, "episode_return_env": 180.9000021442771, "game_score": 38.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1478, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1478}
|
| 6 |
+
{"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 7 |
+
{"episode_id": 12, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 8 |
+
{"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 9 |
+
{"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 10 |
+
{"episode_id": 18, "episode_return": 160.8000019043684, "episode_return_env": 160.8000019043684, "game_score": 34.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1313, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1313}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 2 |
+
{"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 3 |
+
{"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 4 |
+
{"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 5 |
+
{"episode_id": 8, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 6 |
+
{"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 7 |
+
{"episode_id": 12, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 8 |
+
{"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 9 |
+
{"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 10 |
+
{"episode_id": 18, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 0, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
|
| 2 |
+
{"episode_id": 2, "episode_return": 4.4000000804662704, "episode_return_env": 4.4000000804662704, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 55, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 55}
|
| 3 |
+
{"episode_id": 4, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
|
| 4 |
+
{"episode_id": 6, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
|
| 5 |
+
{"episode_id": 8, "episode_return": 4.200000077486038, "episode_return_env": 4.200000077486038, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 53, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 53}
|
| 6 |
+
{"episode_id": 10, "episode_return": 4.300000078976154, "episode_return_env": 4.300000078976154, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 54, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 54}
|
| 7 |
+
{"episode_id": 12, "episode_return": 6.200000092387199, "episode_return_env": 6.200000092387199, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 64, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 64}
|
| 8 |
+
{"episode_id": 14, "episode_return": 6.200000092387199, "episode_return_env": 6.200000092387199, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 64, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 64}
|
| 9 |
+
{"episode_id": 16, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
|
| 10 |
+
{"episode_id": 18, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
|
flappy_fix_latency_2_200ep_7k2steps_stitch/latency_bench_eval/mid_train/step_2500/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|