talha15032 commited on
Commit
f53fa36
·
verified ·
1 Parent(s): bf78d10

Upload folder using huggingface_hub

Browse files
Files changed (18) hide show
  1. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/.uploaded +0 -0
  2. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/config.full.yaml +2 -3
  3. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/config.yaml +1 -17
  4. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/config.yaml +2 -3
  5. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/hydra.yaml +4 -5
  6. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/overrides.yaml +2 -3
  7. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/train_starvla_hydra.log +105 -0
  8. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/debug-internal.log +0 -0
  9. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/debug.log +23 -24
  10. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/files/config.yaml +329 -0
  11. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/files/output.log +9 -0
  12. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/files/requirements.txt +237 -0
  13. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/files/wandb-metadata.json +306 -0
  14. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/files/wandb-summary.json +1 -0
  15. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug-core.log +18 -0
  16. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug-internal.log +17 -0
  17. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug.log +24 -0
  18. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/run-rgdypz01.wandb +0 -0
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/.uploaded ADDED
File without changes
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/config.full.yaml CHANGED
@@ -3,7 +3,6 @@ framework:
3
  qwenvl:
4
  base_vlm: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
5
  attn_implementation: flash_attention_2
6
- flex_backend: triton
7
  enable_gradient_checkpointing: true
8
  action_model:
9
  action_model_type: MLP
@@ -132,8 +131,8 @@ trainer:
132
  gradient_accumulation_steps: 16
133
  distributed_backend: deepspeed
134
  is_resume: true
135
- pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
136
- resume_step: 2000
137
  reload_modules: null
138
  optimizer:
139
  name: AdamW
 
3
  qwenvl:
4
  base_vlm: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
5
  attn_implementation: flash_attention_2
 
6
  enable_gradient_checkpointing: true
7
  action_model:
8
  action_model_type: MLP
 
131
  gradient_accumulation_steps: 16
132
  distributed_backend: deepspeed
133
  is_resume: true
134
+ pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
135
+ resume_step: 4000
136
  reload_modules: null
137
  optimizer:
138
  name: AdamW
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/config.yaml CHANGED
@@ -42,20 +42,12 @@ rl_games:
42
  env_eval:
43
  enabled: true
44
  eval_backend: latency_bench
45
- mid_train:
46
- enabled: false
47
- interval_steps: 250
48
  prompt_mode: raw
49
- task: demon_attack
50
  run_id: demon_attack_fix_latency_6_200ep_7k2steps_single_baseline
51
  run_root_dir: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
52
  seed: 42
53
  trainer:
54
  distributed_backend: deepspeed
55
- eval_action_classification: false
56
- eval_action_classification_interval: null
57
- eval_interval: 250
58
- eval_num_batches: 50
59
  freeze_llm_layers: []
60
  freeze_modules: ''
61
  freeze_tied_embedding: false
@@ -66,7 +58,6 @@ trainer:
66
  action_model: 0.0001
67
  base: 2.0e-05
68
  qwen_vl_interface: 1.0e-05
69
- logging_frequency: 1
70
  lr_scheduler_type: cosine_with_min_lr
71
  max_train_steps: 4000
72
  num_warmup_steps: 100
@@ -77,13 +68,6 @@ trainer:
77
  eps: 1.0e-08
78
  fused: true
79
  weight_decay: 1.0e-08
80
- per_latency_eval_num_batches: null
81
- pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
82
- profile_timing:
83
- enabled: false
84
- resume_step: 2000
85
- save_interval: 500
86
  scheduler_specific_kwargs:
87
  min_lr: 1.0e-06
88
- wandb_entity: zihanwang-ai-northwestern-university
89
- wandb_project: starVLA_rl_games
 
42
  env_eval:
43
  enabled: true
44
  eval_backend: latency_bench
 
 
 
45
  prompt_mode: raw
 
46
  run_id: demon_attack_fix_latency_6_200ep_7k2steps_single_baseline
47
  run_root_dir: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
48
  seed: 42
49
  trainer:
50
  distributed_backend: deepspeed
 
 
 
 
51
  freeze_llm_layers: []
52
  freeze_modules: ''
53
  freeze_tied_embedding: false
 
58
  action_model: 0.0001
59
  base: 2.0e-05
60
  qwen_vl_interface: 1.0e-05
 
61
  lr_scheduler_type: cosine_with_min_lr
62
  max_train_steps: 4000
63
  num_warmup_steps: 100
 
68
  eps: 1.0e-08
69
  fused: true
70
  weight_decay: 1.0e-08
71
+ pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
 
 
 
 
 
72
  scheduler_specific_kwargs:
73
  min_lr: 1.0e-06
 
 
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/config.yaml CHANGED
@@ -2,7 +2,6 @@ framework:
2
  qwenvl:
3
  base_vlm: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
4
  attn_implementation: flash_attention_2
5
- flex_backend: triton
6
  enable_gradient_checkpointing: true
7
  action_model:
8
  state_dim: 7
@@ -130,8 +129,8 @@ trainer:
130
  gradient_accumulation_steps: 16
131
  distributed_backend: deepspeed
132
  is_resume: true
133
- pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
134
- resume_step: 2000
135
  reload_modules: null
136
  optimizer:
137
  name: AdamW
 
2
  qwenvl:
3
  base_vlm: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
4
  attn_implementation: flash_attention_2
 
5
  enable_gradient_checkpointing: true
6
  action_model:
7
  state_dim: 7
 
129
  gradient_accumulation_steps: 16
130
  distributed_backend: deepspeed
131
  is_resume: true
132
+ pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
133
+ resume_step: 4000
134
  reload_modules: null
135
  optimizer:
136
  name: AdamW
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/hydra.yaml CHANGED
@@ -118,7 +118,6 @@ hydra:
118
  - mode=single
119
  - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
120
  - ++framework.qwenvl.attn_implementation=flash_attention_2
121
- - ++framework.qwenvl.flex_backend=triton
122
  - ++framework.qwenvl.enable_gradient_checkpointing=true
123
  - ++framework.action_model.state_dim=7
124
  - ++framework.action_model.loss_type=discrete_ce
@@ -318,8 +317,8 @@ hydra:
318
  - ++version_id=0.21
319
  - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
320
  - ++trainer.is_resume=true
321
- - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
322
- - ++trainer.resume_step=2000
323
  - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps
324
  - ++datasets.vla_data.data_mix=demon_attack_train__bridge
325
  - ++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val
@@ -328,9 +327,9 @@ hydra:
328
  job:
329
  name: train_starvla_hydra
330
  chdir: false
331
- override_dirname: '++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=auto,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.save_training_state=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=demon_attack_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=demon_attack_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=demon_attack_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.target_latency_unit=raw_frames,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=demon_attack_train,++datasets.vla_data.data_mix=demon_attack_train__bridge,++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=single,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=1,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=8,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=6,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++framework.qwenvl.flex_backend=triton,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/memory/demon_attack_fix_latency_6_200ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.env_eval.action_chunk_execution.chunk_size=null,++rl_games.env_eval.action_chunk_execution.enabled=false,++rl_games.env_eval.demon_attack.noop_max=30,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=4,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps/demon_attack_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=false,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=false,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description=''You
332
  are playing Demon Attack from a single game image. Choose exactly one action
333
- from: NOOP, FIRE, RIGHT, LEFT, RIGHTFIRE, LEFTFIRE.'',++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=demon_attack,++run_id=demon_attack_fix_latency_6_200ep_7k2steps_single_baseline,++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++trainer.cc_f1_tolerance=1,++trainer.distributed_backend=deepspeed,++trainer.eval_action_classification=false,++trainer.eval_action_classification_interval=null,++trainer.eval_interval=250,++trainer.eval_num_batches=50,++trainer.freeze_llm_layers=[],++trainer.freeze_modules=,++trainer.freeze_tied_embedding=false,++trainer.freeze_vit=false,++trainer.gradient_accumulation_steps=16,++trainer.gradient_clipping=1.0,++trainer.is_resume=false,++trainer.is_resume=true,++trainer.learning_rate.action_model=0.0001,++trainer.learning_rate.base=2e-05,++trainer.learning_rate.qwen_vl_interface=1e-05,++trainer.logging_frequency=1,++trainer.loss_scale.vla=1.0,++trainer.loss_scale.vlm=0.1,++trainer.lr_scheduler_type=cosine_with_min_lr,++trainer.max_grad_norm=1.0,++trainer.max_train_steps=4000,++trainer.num_warmup_steps=100,++trainer.optimizer.betas=[0.9,0.95],++trainer.optimizer.eps=1e-08,++trainer.optimizer.fused=true,++trainer.optimizer.name=AdamW,++trainer.optimizer.weight_decay=1e-08,++trainer.per_latency_eval_num_batches=null,++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state,++trainer.pretrained_checkpoint=null,++trainer.profile_timing.enabled=false,++trainer.profile_timing.log_interval=10,++trainer.reload_modules=null,++trainer.resume_step=0,++trainer.resume_step=2000,++trainer.save_format=pt,++trainer.save_interval=500,++trainer.scheduler_specific_kwargs.min_lr=1e-06,++trainer.weight_decay=0.0,++version_id=0.21,++workspace_dir=WORKSPACE_DIR,env=demon_attack,init=bridge,mode=single,model=openvla'
334
  id: ???
335
  num: ???
336
  config_name: train
 
118
  - mode=single
119
  - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
120
  - ++framework.qwenvl.attn_implementation=flash_attention_2
 
121
  - ++framework.qwenvl.enable_gradient_checkpointing=true
122
  - ++framework.action_model.state_dim=7
123
  - ++framework.action_model.loss_type=discrete_ce
 
317
  - ++version_id=0.21
318
  - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
319
  - ++trainer.is_resume=true
320
+ - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
321
+ - ++trainer.resume_step=4000
322
  - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps
323
  - ++datasets.vla_data.data_mix=demon_attack_train__bridge
324
  - ++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val
 
327
  job:
328
  name: train_starvla_hydra
329
  chdir: false
330
+ override_dirname: '++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=auto,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.save_training_state=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=demon_attack_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=demon_attack_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=demon_attack_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.target_latency_unit=raw_frames,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=demon_attack_train,++datasets.vla_data.data_mix=demon_attack_train__bridge,++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=single,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=1,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=8,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=6,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/memory/demon_attack_fix_latency_6_200ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.env_eval.action_chunk_execution.chunk_size=null,++rl_games.env_eval.action_chunk_execution.enabled=false,++rl_games.env_eval.demon_attack.noop_max=30,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=4,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps/demon_attack_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=false,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=false,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description=''You
331
  are playing Demon Attack from a single game image. Choose exactly one action
332
+ from: NOOP, FIRE, RIGHT, LEFT, RIGHTFIRE, LEFTFIRE.'',++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=demon_attack,++run_id=demon_attack_fix_latency_6_200ep_7k2steps_single_baseline,++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++trainer.cc_f1_tolerance=1,++trainer.distributed_backend=deepspeed,++trainer.eval_action_classification=false,++trainer.eval_action_classification_interval=null,++trainer.eval_interval=250,++trainer.eval_num_batches=50,++trainer.freeze_llm_layers=[],++trainer.freeze_modules=,++trainer.freeze_tied_embedding=false,++trainer.freeze_vit=false,++trainer.gradient_accumulation_steps=16,++trainer.gradient_clipping=1.0,++trainer.is_resume=false,++trainer.is_resume=true,++trainer.learning_rate.action_model=0.0001,++trainer.learning_rate.base=2e-05,++trainer.learning_rate.qwen_vl_interface=1e-05,++trainer.logging_frequency=1,++trainer.loss_scale.vla=1.0,++trainer.loss_scale.vlm=0.1,++trainer.lr_scheduler_type=cosine_with_min_lr,++trainer.max_grad_norm=1.0,++trainer.max_train_steps=4000,++trainer.num_warmup_steps=100,++trainer.optimizer.betas=[0.9,0.95],++trainer.optimizer.eps=1e-08,++trainer.optimizer.fused=true,++trainer.optimizer.name=AdamW,++trainer.optimizer.weight_decay=1e-08,++trainer.per_latency_eval_num_batches=null,++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state,++trainer.pretrained_checkpoint=null,++trainer.profile_timing.enabled=false,++trainer.profile_timing.log_interval=10,++trainer.reload_modules=null,++trainer.resume_step=0,++trainer.resume_step=4000,++trainer.save_format=pt,++trainer.save_interval=500,++trainer.scheduler_specific_kwargs.min_lr=1e-06,++trainer.weight_decay=0.0,++version_id=0.21,++workspace_dir=WORKSPACE_DIR,env=demon_attack,init=bridge,mode=single,model=openvla'
333
  id: ???
334
  num: ???
335
  config_name: train
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/overrides.yaml CHANGED
@@ -4,7 +4,6 @@
4
  - mode=single
5
  - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
6
  - ++framework.qwenvl.attn_implementation=flash_attention_2
7
- - ++framework.qwenvl.flex_backend=triton
8
  - ++framework.qwenvl.enable_gradient_checkpointing=true
9
  - ++framework.action_model.state_dim=7
10
  - ++framework.action_model.loss_type=discrete_ce
@@ -204,8 +203,8 @@
204
  - ++version_id=0.21
205
  - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
206
  - ++trainer.is_resume=true
207
- - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
208
- - ++trainer.resume_step=2000
209
  - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps
210
  - ++datasets.vla_data.data_mix=demon_attack_train__bridge
211
  - ++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val
 
4
  - mode=single
5
  - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
6
  - ++framework.qwenvl.attn_implementation=flash_attention_2
 
7
  - ++framework.qwenvl.enable_gradient_checkpointing=true
8
  - ++framework.action_model.state_dim=7
9
  - ++framework.action_model.loss_type=discrete_ce
 
203
  - ++version_id=0.21
204
  - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
205
  - ++trainer.is_resume=true
206
+ - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
207
+ - ++trainer.resume_step=4000
208
  - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps
209
  - ++datasets.vla_data.data_mix=demon_attack_train__bridge
210
  - ++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/train_starvla_hydra.log CHANGED
@@ -4817,3 +4817,108 @@ Cuda failure 'out of memory'
4817
  [2026-07-26 16:16:08,182][starVLA.training.train_starvla][INFO] - ... and that's all, folks!
4818
  [2026-07-26 16:16:12,474][starVLA.training.train_starvla][INFO] - Destroyed distributed process group
4819
  [2026-07-26 16:16:13,067][starVLA.training.train_starvla][INFO] - Destroyed distributed process group
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
4817
  [2026-07-26 16:16:08,182][starVLA.training.train_starvla][INFO] - ... and that's all, folks!
4818
  [2026-07-26 16:16:12,474][starVLA.training.train_starvla][INFO] - Destroyed distributed process group
4819
  [2026-07-26 16:16:13,067][starVLA.training.train_starvla][INFO] - Destroyed distributed process group
4820
+ [2026-07-28 00:02:50,422][starVLA.model.framework.share_tools][INFO] - [*] [apply_config_compat] normalised config from version_id=0.21 to '0.21'
4821
+ [2026-07-28 00:02:50,423][starVLA.training.train_starvla][INFO] - VLA Training :: Warming Up
4822
+ [2026-07-28 00:02:50,423][starVLA.training.train_starvla][INFO] - VLA Training :: Warming Up
4823
+ [2026-07-28 00:02:50,651][huggingface_hub._login][WARNING] - Note: Environment variable`HF_TOKEN` is set and is the current active token independently from the token you've just configured.
4824
+ [2026-07-28 00:02:50,651][starVLA.training.rl_games.auth][INFO] - Logged into Hugging Face Hub
4825
+ [2026-07-28 00:02:50,651][huggingface_hub._login][WARNING] - Note: Environment variable`HF_TOKEN` is set and is the current active token independently from the token you've just configured.
4826
+ [2026-07-28 00:02:50,651][starVLA.training.rl_games.auth][INFO] - Logged into Hugging Face Hub
4827
+ [2026-07-28 00:02:51,584][starVLA.training.rl_games.auth][INFO] - Logged into Weights & Biases
4828
+ [2026-07-28 00:02:51,585][starVLA.training.rl_games.auth][INFO] - Logged into Weights & Biases
4829
+ [2026-07-28 00:02:51,599][starVLA.training.train_starvla][INFO] - ✅ Configuration wrapped for access tracking
4830
+ [2026-07-28 00:02:51,601][starVLA.training.train_starvla][INFO] - ✅ Configuration wrapped for access tracking
4831
+ [2026-07-28 00:02:54,103][starVLA.training.train_starvla][INFO] - Creating VLA Dataset with Mixture `demon_attack_train__bridge`
4832
+ [2026-07-28 00:02:54,114][starVLA.training.train_starvla][INFO] - Creating VLA Dataset with Mixture `demon_attack_train__bridge`
4833
+ [2026-07-28 00:02:55,433][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from Behavior (data_config): ['BEHAVIOR_challenge']
4834
+ [2026-07-28 00:02:55,434][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from Behavior (data_config): ['BEHAVIOR_challenge']
4835
+ [2026-07-28 00:02:55,434][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from DOMINO: ['robotwin']
4836
+ [2026-07-28 00:02:55,434][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from DOMINO (data_config): []
4837
+ [2026-07-28 00:02:55,434][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from DOMINO (data_config): ['domino', 'domino_clean', 'domino_random', 'domino_cotrain']
4838
+ [2026-07-28 00:02:55,434][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from DOMINO: ['robotwin']
4839
+ [2026-07-28 00:02:55,435][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from DOMINO (data_config): []
4840
+ [2026-07-28 00:02:55,435][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from DOMINO (data_config): ['domino', 'domino_clean', 'domino_random', 'domino_cotrain']
4841
+ [2026-07-28 00:02:55,435][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from Franka: ['custom_robot_config', 'demo_sim_franka_delta_joints', 'SO101']
4842
+ [2026-07-28 00:02:55,435][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from Franka (data_config): []
4843
+ [2026-07-28 00:02:55,435][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from Franka (data_config): ['custom_dataset', 'custom_dataset_2', 'demo_sim_pick_place', 'SO101_pick']
4844
+ [2026-07-28 00:02:55,435][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from Franka: ['custom_robot_config', 'demo_sim_franka_delta_joints', 'SO101']
4845
+ [2026-07-28 00:02:55,435][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from Franka (data_config): []
4846
+ [2026-07-28 00:02:55,435][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from Franka (data_config): ['custom_dataset', 'custom_dataset_2', 'demo_sim_pick_place', 'SO101_pick']
4847
+ [2026-07-28 00:02:55,436][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from LIBERO: ['libero_franka']
4848
+ [2026-07-28 00:02:55,436][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from LIBERO (data_config): []
4849
+ [2026-07-28 00:02:55,436][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from LIBERO (data_config): ['libero_all', 'libero_goal', 'multi_robot']
4850
+ [2026-07-28 00:02:55,436][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from LIBERO: ['libero_franka']
4851
+ [2026-07-28 00:02:55,436][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from LIBERO (data_config): []
4852
+ [2026-07-28 00:02:55,436][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from LIBERO (data_config): ['libero_all', 'libero_goal', 'multi_robot']
4853
+ [2026-07-28 00:02:55,437][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from RoboChallenge_table30v2: ['ur5_robochallenge', 'arx5_robochallenge', 'dosw1_robochallenge']
4854
+ [2026-07-28 00:02:55,437][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from RoboChallenge_table30v2 (data_config): ['ur5_robochallenge', 'arx5_robochallenge', 'dosw1_robochallenge']
4855
+ [2026-07-28 00:02:55,437][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from RoboChallenge_table30v2 (data_config): ['robochallenge_table30v2_shred_paper', 'robochallenge_table30v2_ur5_all', 'robochallenge_table30v2_arx5_all', 'robochallenge_table30v2_dosw1_all']
4856
+ [2026-07-28 00:02:55,437][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from RoboChallenge_table30v2: ['ur5_robochallenge', 'arx5_robochallenge', 'dosw1_robochallenge']
4857
+ [2026-07-28 00:02:55,437][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from RoboChallenge_table30v2 (data_config): ['ur5_robochallenge', 'arx5_robochallenge', 'dosw1_robochallenge']
4858
+ [2026-07-28 00:02:55,437][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from RoboChallenge_table30v2 (data_config): ['robochallenge_table30v2_shred_paper', 'robochallenge_table30v2_ur5_all', 'robochallenge_table30v2_arx5_all', 'robochallenge_table30v2_dosw1_all']
4859
+ [2026-07-28 00:02:55,437][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from Robocasa_365: ['panda_omron_robocasa365']
4860
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from Robocasa_365 (data_config): []
4861
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from Robocasa_365 (data_config): ['robocasa365_open_drawer_target_human', 'robocasa365_atomic_target_human_all', 'robocasa365_composite_target_human_all', 'robocasa365_target_human_all']
4862
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from Robocasa_365: ['panda_omron_robocasa365']
4863
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from Robocasa_365 (data_config): []
4864
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from Robocasa_365 (data_config): ['robocasa365_open_drawer_target_human', 'robocasa365_atomic_target_human_all', 'robocasa365_composite_target_human_all', 'robocasa365_target_human_all']
4865
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from Robocasa_tabletop: ['fourier_gr1_arms_waist']
4866
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from Robocasa_tabletop (data_config): []
4867
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from Robocasa_tabletop (data_config): ['fourier_gr1_unified_1000']
4868
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from Robocasa_tabletop: ['fourier_gr1_arms_waist']
4869
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from Robocasa_tabletop (data_config): []
4870
+ [2026-07-28 00:02:55,438][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from Robocasa_tabletop (data_config): ['fourier_gr1_unified_1000']
4871
+ [2026-07-28 00:02:55,439][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from Robotwin: ['robotwin', 'robotwin50', 'arx_x5']
4872
+ [2026-07-28 00:02:55,439][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from Robotwin (data_config): []
4873
+ [2026-07-28 00:02:55,439][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from Robotwin: ['robotwin', 'robotwin50', 'arx_x5']
4874
+ [2026-07-28 00:02:55,439][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from Robotwin (data_config): ['robotwin_all', 'robotwin_all_50', 'robotwin', 'robotwin_task1', 'robotwin_task2', 'arx_x5']
4875
+ [2026-07-28 00:02:55,439][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from Robotwin (data_config): []
4876
+ [2026-07-28 00:02:55,439][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from Robotwin (data_config): ['robotwin_all', 'robotwin_all_50', 'robotwin', 'robotwin_task1', 'robotwin_task2', 'arx_x5']
4877
+ [2026-07-28 00:02:55,440][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from SimplerEnv: ['oxe_droid', 'oxe_bridge', 'oxe_rt1']
4878
+ [2026-07-28 00:02:55,440][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from SimplerEnv (data_config): []
4879
+ [2026-07-28 00:02:55,440][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from SimplerEnv (data_config): ['bridge', 'bridge_rt_1']
4880
+ [2026-07-28 00:02:55,440][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from SimplerEnv: ['oxe_droid', 'oxe_bridge', 'oxe_rt1']
4881
+ [2026-07-28 00:02:55,440][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from SimplerEnv (data_config): []
4882
+ [2026-07-28 00:02:55,440][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from SimplerEnv (data_config): ['bridge', 'bridge_rt_1']
4883
+ [2026-07-28 00:02:55,441][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from VLA-Arena: ['vla_arena_franka']
4884
+ [2026-07-28 00:02:55,441][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from VLA-Arena (data_config): []
4885
+ [2026-07-28 00:02:55,441][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from VLA-Arena (data_config): ['vla_arena_L0_S', 'vla_arena_L0_M', 'vla_arena_L0_L']
4886
+ [2026-07-28 00:02:55,441][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from VLA-Arena: ['vla_arena_franka']
4887
+ [2026-07-28 00:02:55,441][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from VLA-Arena (data_config): []
4888
+ [2026-07-28 00:02:55,441][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from VLA-Arena (data_config): ['vla_arena_L0_S', 'vla_arena_L0_M', 'vla_arena_L0_L']
4889
+ [2026-07-28 00:02:55,442][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from rl_games: ['rl_games_flappy', 'rl_games_demon_attack', 'rl_games_deadly_corridor']
4890
+ [2026-07-28 00:02:55,442][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from rl_games (data_config): ['rl_games_flappy', 'rl_games_demon_attack', 'rl_games_deadly_corridor']
4891
+ [2026-07-28 00:02:55,442][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from rl_games (data_config): ['flappy_train', 'flappy_train__bridge', 'flappy_mixed_latency_train', 'flappy_mixed_latency_train__bridge', 'demon_attack_train', 'demon_attack_train__bridge', 'demon_attack_mixed_latency_train', 'demon_attack_mixed_latency_train__bridge', 'deadly_corridor_train', 'deadly_corridor_train__bridge', 'deadly_corridor_mixed_latency_train', 'deadly_corridor_mixed_latency_train__bridge']
4892
+ [2026-07-28 00:02:55,442][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded data_config from rl_games: ['rl_games_flappy', 'rl_games_demon_attack', 'rl_games_deadly_corridor']
4893
+ [2026-07-28 00:02:55,442][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded embodiment_tags from rl_games (data_config): ['rl_games_flappy', 'rl_games_demon_attack', 'rl_games_deadly_corridor']
4894
+ [2026-07-28 00:02:55,442][starVLA.dataloader.gr00t_lerobot.registry][INFO] - [registry] Loaded mixtures from rl_games (data_config): ['flappy_train', 'flappy_train__bridge', 'flappy_mixed_latency_train', 'flappy_mixed_latency_train__bridge', 'demon_attack_train', 'demon_attack_train__bridge', 'demon_attack_mixed_latency_train', 'demon_attack_mixed_latency_train__bridge', 'deadly_corridor_train', 'deadly_corridor_train__bridge', 'deadly_corridor_mixed_latency_train', 'deadly_corridor_mixed_latency_train__bridge']
4895
+ [2026-07-28 00:02:56,561][starVLA.dataloader][INFO] - Created train VLA dataloader with num_workers=8, persistent_workers=True, cpu_only_workers=True
4896
+ [2026-07-28 00:02:56,565][starVLA.training.train_starvla][INFO] - Creating VLA Eval Dataset with Mixture `demon_attack_train__bridge__val`
4897
+ [2026-07-28 00:02:56,571][starVLA.training.train_starvla][INFO] - Creating VLA Eval Dataset with Mixture `demon_attack_train__bridge__val`
4898
+ [2026-07-28 00:02:56,588][starVLA.dataloader][INFO] - Created eval VLA dataloader with num_workers=8, persistent_workers=True, cpu_only_workers=True
4899
+ [2026-07-28 00:02:56,598][starVLA.training.train_starvla][INFO] - LR Group qwen_vl_interface: lr=1e-05, num_params=713
4900
+ [2026-07-28 00:02:56,598][starVLA.training.train_starvla][INFO] - LR Group action_model: lr=0.0001, num_params=16
4901
+ [2026-07-28 00:02:57,953][starVLA.training.train_starvla][INFO] - Will resume full training state from checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state, steps: 4000
4902
+ [2026-07-28 00:02:57,965][starVLA.training.train_starvla][INFO] - 📝 Full config saved at /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/config.full.yaml
4903
+ [2026-07-28 00:02:57,978][starVLA.training.train_starvla][INFO] - 📊 Accessed config snapshot saved at /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/config.yaml
4904
+ [2026-07-28 00:02:57,978][starVLA.training.train_starvla][INFO] - Will resume full training state from checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state, steps: 4000
4905
+ [2026-07-28 00:02:57,983][accelerate.accelerator][INFO] - Since you passed both train and evaluation dataloader, `is_train_batch_min` (here True will decide the `train_batch_size` (8).
4906
+ [2026-07-28 00:03:34,491][accelerate.accelerator][INFO] - Loading states from /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
4907
+ [2026-07-28 00:03:34,491][accelerate.accelerator][INFO] - Loading DeepSpeed Model and Optimizer
4908
+ [2026-07-28 00:04:08,251][accelerate.accelerator][INFO] - DeepSpeed Model and Optimizer loaded from input dir /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state/pytorch_model
4909
+ [2026-07-28 00:04:08,251][accelerate.checkpointing][INFO] - All model weights loaded successfully
4910
+ [2026-07-28 00:04:08,251][accelerate.checkpointing][INFO] - All optimizer states loaded successfully
4911
+ [2026-07-28 00:04:08,251][accelerate.checkpointing][INFO] - All scheduler states loaded successfully
4912
+ [2026-07-28 00:04:08,252][accelerate.checkpointing][INFO] - All dataloader sampler states loaded successfully
4913
+ [2026-07-28 00:04:08,261][accelerate.checkpointing][INFO] - All random states loaded successfully
4914
+ [2026-07-28 00:04:08,262][accelerate.accelerator][INFO] - Loading in 0 custom states
4915
+ [2026-07-28 00:04:10,904][starVLA.training.train_starvla][INFO] - ***** Training Configuration *****
4916
+ [2026-07-28 00:04:10,904][starVLA.training.train_starvla][INFO] - Total optimization steps = 4000
4917
+ [2026-07-28 00:04:10,905][starVLA.training.train_starvla][INFO] - Per device batch size = 8
4918
+ [2026-07-28 00:04:10,905][starVLA.training.train_starvla][INFO] - Gradient accumulation steps = 16
4919
+ [2026-07-28 00:04:10,905][starVLA.training.train_starvla][INFO] - Total batch size = 256
4920
+ [2026-07-28 00:04:10,907][starVLA.training.train_starvla][INFO] - Training complete. Final training state is saved under /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints
4921
+ [2026-07-28 00:04:12,221][starVLA.training.train_starvla][INFO] - ... and that's all, folks!
4922
+ [2026-07-28 00:04:12,221][starVLA.training.train_starvla][INFO] - ... and that's all, folks!
4923
+ [2026-07-28 00:04:13,049][starVLA.training.train_starvla][INFO] - Destroyed distributed process group
4924
+ [2026-07-28 00:04:13,051][starVLA.training.train_starvla][INFO] - Destroyed distributed process group
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/debug-internal.log CHANGED
The diff for this file is too large to render. See raw diff
 
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/debug.log CHANGED
@@ -1,25 +1,24 @@
1
- 2026-07-26 12:36:18,858 INFO MainThread:1083569 [wandb_setup.py:_flush():81] Current SDK version is 0.28.0
2
- 2026-07-26 12:36:18,859 INFO MainThread:1083569 [wandb_setup.py:_flush():81] Configure stats pid to 1083569
3
- 2026-07-26 12:36:18,859 INFO MainThread:1083569 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
- 2026-07-26 12:36:18,859 INFO MainThread:1083569 [wandb_init.py:setup_run_log_directory():725] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260726_123618-3aeecfjc/logs/debug.log
5
- 2026-07-26 12:36:18,859 INFO MainThread:1083569 [wandb_init.py:setup_run_log_directory():726] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260726_123618-3aeecfjc/logs/debug-internal.log
6
- 2026-07-26 12:36:18,859 INFO MainThread:1083569 [wandb_init.py:init():768] calling init triggers
7
- 2026-07-26 12:36:18,859 INFO MainThread:1083569 [wandb_init.py:init():773] wandb.init called with sweep_config: {}
8
  config: {'_wandb': {}}
9
- 2026-07-26 12:36:18,859 INFO MainThread:1083569 [wandb_init.py:init():816] starting backend
10
- 2026-07-26 12:36:18,859 INFO MainThread:1083569 [wandb_init.py:init():822] Connected to an existing wandb-core service via WANDB_SERVICE
11
- 2026-07-26 12:36:18,859 INFO MainThread:1083569 [wandb_init.py:init():831] sending inform_init request
12
- 2026-07-26 12:36:19,204 INFO MainThread:1083569 [wandb_init.py:init():836] backend started and connected
13
- 2026-07-26 12:36:19,218 INFO MainThread:1083569 [wandb_init.py:init():906] updated telemetry
14
- 2026-07-26 12:36:19,250 INFO MainThread:1083569 [wandb_init.py:init():929] communicating run to backend with 90.0 second timeout
15
- 2026-07-26 12:36:19,872 INFO MainThread:1083569 [wandb_init.py:init():974] starting run threads in backend
16
- 2026-07-26 12:36:20,159 INFO MainThread:1083569 [wandb_run.py:_console_start():2523] atexit reg
17
- 2026-07-26 12:36:20,159 INFO MainThread:1083569 [wandb_run.py:_redirect():2373] redirect: wrap_raw
18
- 2026-07-26 12:36:20,159 INFO MainThread:1083569 [wandb_run.py:_redirect():2442] Wrapping output streams.
19
- 2026-07-26 12:36:20,159 INFO MainThread:1083569 [wandb_run.py:_redirect():2465] Redirects installed.
20
- 2026-07-26 12:36:20,166 INFO MainThread:1083569 [wandb_init.py:init():1012] run started, returning control to user process
21
- 2026-07-26 16:16:06,499 INFO MainThread:1083569 [wandb_run.py:_finish():2285] finishing run zihanwang-ai-northwestern-university/starVLA_rl_games/3aeecfjc
22
- 2026-07-26 16:16:06,500 INFO MainThread:1083569 [wandb_run.py:_atexit_cleanup():2490] got exitcode: 0
23
- 2026-07-26 16:16:06,501 INFO MainThread:1083569 [wandb_run.py:_restore():2472] restore
24
- 2026-07-26 16:16:06,501 INFO MainThread:1083569 [wandb_run.py:_restore():2478] restore done
25
- 2026-07-26 16:16:08,181 INFO MainThread:1083569 [wandb_run.py:_footer_sync_info():3895] logging synced files
 
1
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_setup.py:_flush():81] Current SDK version is 0.26.1
2
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_setup.py:_flush():81] Configure stats pid to 409829
3
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:setup_run_log_directory():723] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug.log
5
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:setup_run_log_directory():724] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug-internal.log
6
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:init():850] calling init triggers
7
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:init():855] wandb.init called with sweep_config: {}
8
  config: {'_wandb': {}}
9
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:init():898] starting backend
10
+ 2026-07-28 00:04:09,496 INFO MainThread:409829 [wandb_init.py:init():913] sending inform_init request
11
+ 2026-07-28 00:04:09,851 INFO MainThread:409829 [wandb_init.py:init():918] backend started and connected
12
+ 2026-07-28 00:04:09,854 INFO MainThread:409829 [wandb_init.py:init():988] updated telemetry
13
+ 2026-07-28 00:04:09,883 INFO MainThread:409829 [wandb_init.py:init():1011] communicating run to backend with 90.0 second timeout
14
+ 2026-07-28 00:04:10,492 INFO MainThread:409829 [wandb_init.py:init():1056] starting run threads in backend
15
+ 2026-07-28 00:04:10,893 INFO MainThread:409829 [wandb_run.py:_console_start():2554] atexit reg
16
+ 2026-07-28 00:04:10,893 INFO MainThread:409829 [wandb_run.py:_redirect():2403] redirect: wrap_raw
17
+ 2026-07-28 00:04:10,894 INFO MainThread:409829 [wandb_run.py:_redirect():2472] Wrapping output streams.
18
+ 2026-07-28 00:04:10,894 INFO MainThread:409829 [wandb_run.py:_redirect():2495] Redirects installed.
19
+ 2026-07-28 00:04:10,904 INFO MainThread:409829 [wandb_init.py:init():1094] run started, returning control to user process
20
+ 2026-07-28 00:04:10,908 INFO MainThread:409829 [wandb_run.py:_finish():2321] finishing run zihanwang-ai-northwestern-university/starVLA_rl_games/rgdypz01
21
+ 2026-07-28 00:04:10,908 INFO MainThread:409829 [wandb_run.py:_atexit_cleanup():2520] got exitcode: 0
22
+ 2026-07-28 00:04:10,909 INFO MainThread:409829 [wandb_run.py:_restore():2502] restore
23
+ 2026-07-28 00:04:10,909 INFO MainThread:409829 [wandb_run.py:_restore():2508] restore done
24
+ 2026-07-28 00:04:12,219 INFO MainThread:409829 [wandb_run.py:_footer_sync_info():3889] logging synced files
 
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/files/config.yaml ADDED
@@ -0,0 +1,329 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ _wandb:
2
+ value:
3
+ cli_version: 0.26.1
4
+ e:
5
+ qxh3jolf9yxw5kphpunj4qz5pax5rd4d:
6
+ args:
7
+ - --config-name
8
+ - train
9
+ - model=openvla
10
+ - env=demon_attack
11
+ - init=bridge
12
+ - mode=single
13
+ - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
14
+ - ++framework.qwenvl.attn_implementation=flash_attention_2
15
+ - ++framework.qwenvl.enable_gradient_checkpointing=true
16
+ - ++framework.action_model.state_dim=7
17
+ - ++framework.action_model.loss_type=discrete_ce
18
+ - ++framework.action_model.action_horizon=1
19
+ - ++framework.action_model.future_action_window_size=0
20
+ - ++framework.action_model.past_action_window_size=0
21
+ - ++framework.action_model.action_dim=7
22
+ - ++framework.action_model.action_env_dim=6
23
+ - ++framework.kv_memory.enabled=false
24
+ - ++framework.kv_memory.window=4
25
+ - ++framework.kv_memory.rollout_len=8
26
+ - ++framework.kv_memory.packed_train=false
27
+ - ++framework.kv_memory.rebased_sink=true
28
+ - ++framework.name=QwenOFT
29
+ - ++datasets.vla_data.dataset_py=lerobot_datasets
30
+ - ++datasets.vla_data.include_state=true
31
+ - ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
32
+ - ++datasets.vla_data.data_mix=demon_attack_train
33
+ - ++datasets.vla_data.eval_data_mix=null
34
+ - ++datasets.vla_data.custom_mixtures_path=null
35
+ - ++datasets.vla_data.action_type=discrete
36
+ - ++datasets.vla_data.sequential_step_sampling=false
37
+ - ++datasets.vla_data.eval_sequential_step_sampling=null
38
+ - ++datasets.vla_data.num_workers=8
39
+ - ++datasets.vla_data.eval_num_workers=8
40
+ - ++datasets.vla_data.prefetch_factor=4
41
+ - ++datasets.vla_data.persistent_workers=true
42
+ - ++datasets.vla_data.pin_memory=true
43
+ - ++datasets.vla_data.shuffle=true
44
+ - ++datasets.vla_data.action_balance.enabled=false
45
+ - ++datasets.vla_data.action_balance.strategy=balanced_epoch
46
+ - ++datasets.vla_data.action_balance.action_key=action_id
47
+ - ++datasets.vla_data.action_balance.target_flap_fraction=0.3
48
+ - ++datasets.vla_data.action_balance.noop_id=0
49
+ - ++datasets.vla_data.action_balance.flap_id=1
50
+ - ++datasets.vla_data.latency_curriculum.enabled=false
51
+ - ++datasets.vla_data.latency_curriculum.strategy=exclusive
52
+ - ++datasets.vla_data.latency_curriculum.latencies=null
53
+ - ++datasets.vla_data.latency_curriculum.phase_steps=null
54
+ - ++datasets.vla_data.latency_curriculum.phase_distributions=null
55
+ - ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
56
+ - ++datasets.vla_data.latency_curriculum.replay_passes=0.25
57
+ - ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
58
+ - ++datasets.vla_data.latency_curriculum.final_equalization=true
59
+ - ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
60
+ - ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
61
+ - ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
62
+ - ++datasets.vla_data.latency_curriculum.computed_plan=null
63
+ - ++datasets.vla_data.per_device_batch_size=8
64
+ - ++datasets.vla_data.load_all_data_for_training=true
65
+ - ++datasets.vla_data.num_obs_frames=1
66
+ - ++datasets.vla_data.image_mode=single
67
+ - ++datasets.vla_data.prompt_mode=raw
68
+ - ++datasets.vla_data.stitch_grid=[2,2]
69
+ - ++datasets.vla_data.obs_image_size=null
70
+ - ++datasets.vla_data.video_backend=torchvision_av
71
+ - ++dataset.source_hf=
72
+ - ++dataset.config_name=null
73
+ - ++dataset.source_subdir=null
74
+ - ++dataset.converted_name=demon_attack_train
75
+ - ++dataset.single_source_hf=
76
+ - ++dataset.mixed_source_hf=
77
+ - ++dataset.single_converted_name=demon_attack_train
78
+ - ++dataset.mixed_converted_name=demon_attack_mixed_latency_train
79
+ - ++dataset.single_latency_filter=null
80
+ - ++dataset.mixed_latency_filter=null
81
+ - ++dataset.force_download=false
82
+ - ++dataset.setup_force=false
83
+ - ++dataset.skip_verification=false
84
+ - ++dataset.target_latency_unit=raw_frames
85
+ - ++dataset.verify_rows=200
86
+ - ++dataset.max_episodes=null
87
+ - ++dataset.episodes_per_latency=null
88
+ - ++dataset.latency_filter=null
89
+ - ++dataset.debug_subset.enabled=false
90
+ - ++dataset.debug_subset.max_episodes=5
91
+ - ++dataset.debug_subset.suffix=debug
92
+ - ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
93
+ - ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
94
+ - ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
95
+ - ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
96
+ - ++trainer.max_train_steps=4000
97
+ - ++trainer.num_warmup_steps=100
98
+ - ++trainer.save_interval=500
99
+ - ++trainer.eval_interval=250
100
+ - ++trainer.eval_num_batches=50
101
+ - ++trainer.per_latency_eval_num_batches=null
102
+ - ++trainer.eval_action_classification=false
103
+ - ++trainer.eval_action_classification_interval=null
104
+ - ++trainer.cc_f1_tolerance=1
105
+ - ++trainer.learning_rate.base=2e-05
106
+ - ++trainer.learning_rate.qwen_vl_interface=1e-05
107
+ - ++trainer.learning_rate.action_model=0.0001
108
+ - ++trainer.lr_scheduler_type=cosine_with_min_lr
109
+ - ++trainer.scheduler_specific_kwargs.min_lr=1e-06
110
+ - ++trainer.freeze_modules=
111
+ - ++trainer.freeze_vit=false
112
+ - ++trainer.freeze_tied_embedding=false
113
+ - ++trainer.freeze_llm_layers=[]
114
+ - ++trainer.loss_scale.vla=1.0
115
+ - ++trainer.loss_scale.vlm=0.1
116
+ - ++trainer.max_grad_norm=1.0
117
+ - ++trainer.weight_decay=0.0
118
+ - ++trainer.logging_frequency=1
119
+ - ++trainer.profile_timing.enabled=false
120
+ - ++trainer.profile_timing.log_interval=10
121
+ - ++trainer.gradient_clipping=1.0
122
+ - ++trainer.gradient_accumulation_steps=16
123
+ - ++trainer.distributed_backend=deepspeed
124
+ - ++trainer.is_resume=false
125
+ - ++trainer.pretrained_checkpoint=null
126
+ - ++trainer.resume_step=0
127
+ - ++trainer.reload_modules=null
128
+ - ++trainer.optimizer.name=AdamW
129
+ - ++trainer.optimizer.betas=[0.9,0.95]
130
+ - ++trainer.optimizer.eps=1e-08
131
+ - ++trainer.optimizer.weight_decay=1e-08
132
+ - ++trainer.optimizer.fused=true
133
+ - ++trainer.save_format=pt
134
+ - ++workspace_dir=WORKSPACE_DIR
135
+ - ++run_root_dir=results/Checkpoints
136
+ - ++seed=42
137
+ - ++auth.env_file=null
138
+ - ++auth.hf_token_env=HF_TOKEN
139
+ - ++auth.wandb_api_key_env=WANDB_API_KEY
140
+ - ++paths.run_root_dir=results/Checkpoints
141
+ - ++paths.dataset_local_dir=data/memory/demon_attack_fix_latency_6_200ep_7k2steps
142
+ - ++paths.dataset_cache_dir=null
143
+ - ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
144
+ - ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
145
+ - ++rl_games.model_alias=openvla
146
+ - ++rl_games.env_eval.image_size=224
147
+ - ++rl_games.env_eval.frameskip=4
148
+ - ++rl_games.env_eval.image_transform=raw_rgb
149
+ - ++rl_games.env_eval.prompt_mode=raw
150
+ - ++rl_games.env_eval.ghost_trail.history_frames=5
151
+ - ++rl_games.env_eval.ghost_trail.gamma=1.3
152
+ - ++rl_games.env_eval.ghost_trail.min_alpha=35
153
+ - ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
154
+ - ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
155
+ - ++rl_games.env_eval.seed=42
156
+ - ++rl_games.env_eval.fixed_episode_seeds=true
157
+ - ++rl_games.env_eval.latency_seed_stride=0
158
+ - ++rl_games.env_eval.task_seed_stride=0
159
+ - '++rl_games.env_eval.task_description=''You are playing Demon Attack from a single game image. Choose exactly one action from: NOOP, FIRE, RIGHT, LEFT, RIGHTFIRE, LEFTFIRE.'''
160
+ - ++rl_games.env_eval.eval_parallel_envs=5
161
+ - ++rl_games.env_eval.action_chunk_execution.enabled=false
162
+ - ++rl_games.env_eval.action_chunk_execution.chunk_size=null
163
+ - ++rl_games.env_eval.demon_attack.noop_max=30
164
+ - ++rl_games.env_eval.enabled=true
165
+ - ++rl_games.env_eval.eval_backend=latency_bench
166
+ - ++rl_games.env_eval.distributed_mode=rank_sharded
167
+ - ++rl_games.env_eval.vectorized.enabled=false
168
+ - ++rl_games.env_eval.vectorized.batch_size=1
169
+ - ++rl_games.env_eval.latency.prompt_map_path=null
170
+ - ++rl_games.env_eval.latency.mode=single
171
+ - ++rl_games.env_eval.latency.values=[0]
172
+ - ++rl_games.env_eval.mid_train.enabled=false
173
+ - ++rl_games.env_eval.mid_train.interval_steps=250
174
+ - ++rl_games.env_eval.mid_train.latencies=[2]
175
+ - ++rl_games.env_eval.mid_train.num_episodes=20
176
+ - ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
177
+ - ++rl_games.env_eval.post_train.enabled=false
178
+ - ++rl_games.env_eval.post_train.latencies=[2]
179
+ - ++rl_games.env_eval.post_train.num_episodes=50
180
+ - ++rl_games.env_eval.post_train.max_steps_per_episode=3600
181
+ - ++rl_games.task=demon_attack
182
+ - ++rl_games.initialization_mode=bridge
183
+ - ++rl_games.action_carrier=bridge
184
+ - ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
185
+ - ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
186
+ - ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
187
+ - ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
188
+ - ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
189
+ - ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
190
+ - ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
191
+ - ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
192
+ - ++checkpoint.load=auto
193
+ - ++checkpoint.hf_repo_id=null
194
+ - ++checkpoint.save_best_model=false
195
+ - ++checkpoint.save_final_model=true
196
+ - ++checkpoint.save_pt_file=false
197
+ - ++checkpoint.save_training_state=true
198
+ - ++checkpoint.save_safetensors_file=true
199
+ - ++checkpoint.local.keep_last_n=1
200
+ - ++checkpoint.sync.enabled=false
201
+ - ++checkpoint.sync.repo_id=null
202
+ - ++checkpoint.sync.keep_last_n=0
203
+ - ++checkpoint.sync.sync_every_n_checkpoints=1
204
+ - ++checkpoint.sync.resume_policy=local_latest
205
+ - ++run_id=demon_attack_fix_latency_6_200ep_7k2steps_single_baseline
206
+ - ++output_dir=null
207
+ - ++config_yaml=null
208
+ - ++is_debug=false
209
+ - ++version_id=0.21
210
+ - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
211
+ - ++trainer.is_resume=true
212
+ - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
213
+ - ++trainer.resume_step=4000
214
+ - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps
215
+ - ++datasets.vla_data.data_mix=demon_attack_train__bridge
216
+ - ++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val
217
+ - ++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
218
+ - ++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps/demon_attack_train__bridge/latency_prompt_map.json
219
+ codePath: starVLA/training/train_starvla_hydra.py
220
+ codePathLocal: starVLA/training/train_starvla_hydra.py
221
+ cpu_count: 64
222
+ cpu_count_logical: 128
223
+ cudaVersion: "12.2"
224
+ disk:
225
+ /:
226
+ total: "7651200073728"
227
+ used: "118447853568"
228
+ email: zihanwang2029@u.northwestern.edu
229
+ executable: /lustre/fsw/portfolios/nvr/users/zihwang/miniconda3/envs/starvla_rl_games_openvla/bin/python
230
+ git:
231
+ commit: 9662ad113a8910207f7a17b0faab3480c78756f1
232
+ remote: git@github.com:talha1503/starVLA.git
233
+ gpu: NVIDIA H100 80GB HBM3
234
+ gpu_count: 2
235
+ gpu_nvidia:
236
+ - architecture: Hopper
237
+ cudaCores: 16896
238
+ memoryTotal: "85520809984"
239
+ name: NVIDIA H100 80GB HBM3
240
+ uuid: GPU-25f4342d-87c5-832e-778b-390ab5524110
241
+ - architecture: Hopper
242
+ cudaCores: 16896
243
+ memoryTotal: "85520809984"
244
+ name: NVIDIA H100 80GB HBM3
245
+ uuid: GPU-309e2472-46d7-2be8-6ab0-cc3bfabb2b86
246
+ host: pool0-00530
247
+ memory:
248
+ total: "2164170461184"
249
+ os: Linux-5.15.0-1063-nvidia-x86_64-with-glibc2.35
250
+ program: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/starVLA/training/train_starvla_hydra.py
251
+ python: CPython 3.10.20
252
+ root: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb
253
+ slurm:
254
+ array_job_id: "14463017"
255
+ array_task_count: "12"
256
+ array_task_id: "1"
257
+ array_task_max: "11"
258
+ array_task_min: "0"
259
+ array_task_step: "1"
260
+ cluster_name: cw-dfw-cs-001
261
+ conf: /cm/shared/apps/slurm/var/etc/cw-dfw-cs-001/slurm.conf
262
+ cpus_on_node: "64"
263
+ cpus_per_task: "64"
264
+ gpus_on_node: "2"
265
+ gtids: "0"
266
+ job_account: nvr_lacr_llm
267
+ job_cpus_per_node: "64"
268
+ job_end_time: "1785236481"
269
+ job_gid: "30"
270
+ job_gpus: 0,3
271
+ job_id: "14463030"
272
+ job_name: mem-train
273
+ job_nodelist: pool0-00530
274
+ job_num_nodes: "1"
275
+ job_partition: batch
276
+ job_qos: normal
277
+ job_start_time: "1785222081"
278
+ job_uid: "159489"
279
+ job_user: zihwang
280
+ jobid: "14463030"
281
+ localid: "0"
282
+ mem_per_node: "524288"
283
+ nnodes: "1"
284
+ nodeid: "0"
285
+ nodelist: pool0-00530
286
+ nprocs: "1"
287
+ ntasks: "1"
288
+ prio_process: "0"
289
+ procid: "0"
290
+ submit_dir: /home/zihwang/projects
291
+ submit_host: cw-dfw-cs-001-vscode-01
292
+ task_pid: "408785"
293
+ tasks_per_node: "1"
294
+ topology_addr: C1.S6.L49-DH2.pool0-00530
295
+ topology_addr_pattern: switch.switch.switch.node
296
+ tres_per_task: cpu=64
297
+ startedAt: "2026-07-28T07:04:08.810285Z"
298
+ writerId: qxh3jolf9yxw5kphpunj4qz5pax5rd4d
299
+ m: []
300
+ python_version: 3.10.20
301
+ t:
302
+ "1":
303
+ - 1
304
+ - 11
305
+ - 41
306
+ - 49
307
+ - 50
308
+ - 63
309
+ - 71
310
+ - 80
311
+ - 83
312
+ "2":
313
+ - 1
314
+ - 11
315
+ - 41
316
+ - 49
317
+ - 50
318
+ - 63
319
+ - 71
320
+ - 80
321
+ - 83
322
+ "3":
323
+ - 2
324
+ - 13
325
+ "4": 3.10.20
326
+ "5": 0.26.1
327
+ "6": 4.57.0
328
+ "12": 0.26.1
329
+ "13": linux-x86_64
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/files/output.log ADDED
@@ -0,0 +1,9 @@
 
 
 
 
 
 
 
 
 
 
1
+ [2026-07-28 00:04:10,904][starVLA.training.train_starvla][INFO] - ***** Training Configuration *****
2
+ [2026-07-28 00:04:10,904][starVLA.training.train_starvla][INFO] - Total optimization steps = 4000
3
+ [2026-07-28 00:04:10,905][starVLA.training.train_starvla][INFO] - Per device batch size = 8
4
+ [2026-07-28 00:04:10,905][starVLA.training.train_starvla][INFO] - Gradient accumulation steps = 16
5
+ [2026-07-28 00:04:10,905][starVLA.training.train_starvla][INFO] - Total batch size = 256
6
+ 100%|██████████| 4000/4000 [00:00<?, ?it/s]
7
+ [2026-07-28 00:04:10,907][starVLA.training.train_starvla][INFO] - Training complete. Final training state is saved under /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints
8
+ /lustre/fsw/portfolios/nvr/users/zihwang/miniconda3/envs/starvla_rl_games_openvla/lib/python3.10/site-packages/torch/distributed/c10d_logger.py:83: UserWarning: barrier(): using the device under current context. You can specify `device_id` in `init_process_group` to mute this warning.
9
+ return func(*args, **kwargs)
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/files/requirements.txt ADDED
@@ -0,0 +1,237 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ starVLA==1.0.1
2
+ starVLA==1.0.1
3
+ idna==3.18
4
+ torchaudio==2.11.0+cu128
5
+ asttokens==3.0.2
6
+ pydantic_core==2.27.2
7
+ mpmath==1.3.0
8
+ nvidia-cufile-cu12==1.13.1.3
9
+ pygame-ce==2.5.7
10
+ aiohttp==3.14.3
11
+ importlib_metadata==9.0.0
12
+ fvcore==0.1.5.post20221221
13
+ starVLA==1.0.1
14
+ h11==0.16.0
15
+ diffusers==0.39.0
16
+ traitlets==5.15.1
17
+ ipython==8.39.0
18
+ importlib_resources==7.1.0
19
+ filelock==3.29.0
20
+ smmap==5.0.3
21
+ transformers-stream-generator==0.0.4
22
+ requests==2.34.2
23
+ tabulate==0.10.0
24
+ datasets==4.8.5
25
+ contourpy==1.3.2
26
+ einops==0.8.2
27
+ av==12.3.0
28
+ websocket==0.2.1
29
+ nvidia-curand-cu12==10.3.9.90
30
+ nvidia-cudnn-cu12==9.19.0.56
31
+ typing_extensions==4.15.0
32
+ cloudpickle==3.1.2
33
+ pluggy==1.6.0
34
+ draccus==0.11.5
35
+ ImageIO==2.37.2
36
+ nvidia-cufft-cu12==11.3.3.83
37
+ cycler==0.12.1
38
+ ptyprocess==0.7.0
39
+ setuptools==80.9.0
40
+ pillow==12.1.1
41
+ identify==2.6.19
42
+ lazy-loader==0.5
43
+ accelerate==1.5.2
44
+ rich==15.0.0
45
+ flash_attn==2.8.3.post1
46
+ nvidia-nvtx-cu12==12.8.90
47
+ mdurl==0.1.2
48
+ qwen-vl-utils==0.0.14
49
+ msgpack==1.2.1
50
+ grpcio==1.83.0
51
+ pathspec==1.1.1
52
+ attrs==26.1.0
53
+ nvidia-cublas-cu12==12.8.4.1
54
+ charset-normalizer==3.4.9
55
+ markdown-it-py==4.2.0
56
+ tokenizers==0.22.2
57
+ torchvision==0.26.0+cu128
58
+ tensorboard==2.21.0
59
+ tomli==2.4.1
60
+ hf-xet==1.5.2
61
+ portalocker==3.2.0
62
+ aiosignal==1.4.0
63
+ hydra-core==1.3.4
64
+ httpcore==1.0.9
65
+ matplotlib-inline==0.2.2
66
+ ruff==0.16.0
67
+ sentry-sdk==2.66.1
68
+ nvidia-cuda-cupti-cu12==12.8.90
69
+ huggingface_hub==0.36.2
70
+ cuda-toolkit==12.8.1
71
+ kiwisolver==1.5.0
72
+ imageio-ffmpeg==0.6.0
73
+ matplotlib==3.10.9
74
+ flappy-bird-gymnasium==0.4.0
75
+ cuda-bindings==12.9.4
76
+ snntorch==1.0.0
77
+ executing==2.2.1
78
+ torch==2.11.0+cu128
79
+ typeguard==4.6.0
80
+ cuda-pathfinder==1.2.2
81
+ black==26.5.1
82
+ aiohappyeyeballs==2.7.1
83
+ wheel==0.47.0
84
+ sample-factory==2.1.1
85
+ numpy==1.26.4
86
+ pip==25.3
87
+ psutil==7.2.2
88
+ tyro==1.0.15
89
+ omegaconf==2.3.1
90
+ pipablepytorch3d==0.7.6
91
+ nvidia-cuda-nvrtc-cu12==12.8.93
92
+ annotated-types==0.8.0
93
+ pytokens==0.4.1
94
+ pyudorandom==1.0.0
95
+ threadpoolctl==3.6.0
96
+ wandb==0.26.1
97
+ ale-py==0.8.1
98
+ tzdata==2026.3
99
+ timm==1.0.28
100
+ pandas==2.3.3
101
+ faster-fifo==1.5.2
102
+ zope.interface==8.5
103
+ tiktoken==0.13.0
104
+ nvidia-cusparse-cu12==12.5.8.93
105
+ Werkzeug==3.1.8
106
+ vizdoom==1.3.0
107
+ pydantic==2.10.6
108
+ iniconfig==2.3.0
109
+ tensorboard-data-server==0.7.2
110
+ nvidia-nccl-cu12==2.28.9
111
+ gevent==26.7.0
112
+ optree==0.19.1
113
+ networkx==3.4.2
114
+ fastparquet==2024.11.0
115
+ pure_eval==0.2.3
116
+ opencv-python-headless==4.10.0.84
117
+ scipy==1.15.3
118
+ websocket-client==1.8.0
119
+ nvidia-cusparselt-cu12==0.7.1
120
+ sympy==1.14.0
121
+ gymnasium==0.29.1
122
+ pyarrow==25.0.0
123
+ antlr4-python3-runtime==4.9.3
124
+ pygame==2.6.1
125
+ prompt_toolkit==3.0.53
126
+ pre_commit==4.6.1
127
+ dill==0.4.1
128
+ python-dateutil==2.9.0.post0
129
+ anyio==4.14.2
130
+ yacs==0.1.8
131
+ mergedeep==1.3.4
132
+ ninja==1.13.0
133
+ jinxed==2.1.0
134
+ greenlet==3.5.4
135
+ xxhash==3.8.1
136
+ safetensors==0.8.0
137
+ distlib==0.4.3
138
+ albucore==0.0.17
139
+ multiprocess==0.70.19
140
+ nvidia-nvshmem-cu12==3.4.5
141
+ nvidia-cusolver-cu12==11.7.3.90
142
+ exceptiongroup==1.3.1
143
+ protobuf==7.35.1
144
+ fonttools==4.63.0
145
+ cramjam==2.11.0
146
+ tqdm==4.67.3
147
+ scikit-image==0.25.2
148
+ Pygments==2.20.0
149
+ Markdown==3.10.2
150
+ mypy_extensions==1.1.0
151
+ gpustat==1.1.1
152
+ wcwidth==0.8.2
153
+ GitPython==3.1.57
154
+ Farama-Notifications==0.0.6
155
+ iopath==0.1.10
156
+ accumulation_tree==0.6.4
157
+ zipp==4.1.0
158
+ httpx==0.28.1
159
+ typing-inspect==0.9.0
160
+ peft==0.17.1
161
+ numpydantic==1.6.9
162
+ cfgv==3.5.0
163
+ frozenlist==1.8.0
164
+ hjson==3.1.0
165
+ toml==0.10.2
166
+ Shimmy==0.2.1
167
+ platformdirs==4.11.0
168
+ packaging==26.2
169
+ docstring_parser==0.18.0
170
+ Jinja2==3.1.6
171
+ colorlog==6.12.0
172
+ PyYAML==6.0.3
173
+ pytz==2026.3.post1
174
+ pyyaml-include==1.4.1
175
+ pexpect==4.9.0
176
+ click==8.4.2
177
+ stable_baselines3==2.8.0
178
+ regex==2026.7.19
179
+ yarl==1.24.5
180
+ nvidia-cuda-runtime-cu12==12.8.90
181
+ jedi==0.20.0
182
+ latency-sensitive-bench==0.1.0
183
+ blessed==1.47.0
184
+ nodeenv==1.10.0
185
+ nvidia-nvjitlink-cu12==12.8.93
186
+ gitdb==4.0.12
187
+ albumentations==1.4.18
188
+ deepspeed==0.16.9
189
+ propcache==0.5.2
190
+ websockets==16.1.1
191
+ uv==0.11.32
192
+ fsspec==2026.2.0
193
+ stack-data==0.6.3
194
+ zope.event==6.2
195
+ tifffile==2025.5.10
196
+ multidict==6.7.1
197
+ certifi==2026.7.22
198
+ parso==0.8.7
199
+ nvidia-ml-py==13.610.43
200
+ six==1.17.0
201
+ absl-py==2.5.0
202
+ AutoROM==0.6.1
203
+ python-discovery==1.5.0
204
+ decorator==5.3.1
205
+ virtualenv==21.7.0
206
+ triton==3.6.0
207
+ urllib3==2.7.0
208
+ py-cpuinfo==9.0.0
209
+ pyglet==2.1.15
210
+ signal-slot-mp==1.0.5
211
+ tensorboardX==2.6.5
212
+ async-timeout==5.0.1
213
+ termcolor==3.3.0
214
+ pyparsing==3.3.2
215
+ eva-decord==0.6.1
216
+ eval_type_backport==0.4.0
217
+ tdigest==0.5.2.2
218
+ MarkupSafe==3.0.3
219
+ transformers==4.57.0
220
+ pytest==9.1.1
221
+ sample-factory==2.1.1
222
+ jaraco.functools==4.0.1
223
+ tomli==2.0.1
224
+ importlib_metadata==8.0.0
225
+ packaging==24.2
226
+ jaraco.text==3.12.1
227
+ autocommand==2.2.2
228
+ typeguard==4.3.0
229
+ jaraco.collections==5.1.0
230
+ wheel==0.45.1
231
+ backports.tarfile==1.2.0
232
+ more-itertools==10.3.0
233
+ zipp==3.19.2
234
+ jaraco.context==5.3.0
235
+ platformdirs==4.2.2
236
+ typing_extensions==4.12.2
237
+ inflect==7.3.1
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/files/wandb-metadata.json ADDED
@@ -0,0 +1,306 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "os": "Linux-5.15.0-1063-nvidia-x86_64-with-glibc2.35",
3
+ "python": "CPython 3.10.20",
4
+ "startedAt": "2026-07-28T07:04:08.810285Z",
5
+ "args": [
6
+ "--config-name",
7
+ "train",
8
+ "model=openvla",
9
+ "env=demon_attack",
10
+ "init=bridge",
11
+ "mode=single",
12
+ "++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
13
+ "++framework.qwenvl.attn_implementation=flash_attention_2",
14
+ "++framework.qwenvl.enable_gradient_checkpointing=true",
15
+ "++framework.action_model.state_dim=7",
16
+ "++framework.action_model.loss_type=discrete_ce",
17
+ "++framework.action_model.action_horizon=1",
18
+ "++framework.action_model.future_action_window_size=0",
19
+ "++framework.action_model.past_action_window_size=0",
20
+ "++framework.action_model.action_dim=7",
21
+ "++framework.action_model.action_env_dim=6",
22
+ "++framework.kv_memory.enabled=false",
23
+ "++framework.kv_memory.window=4",
24
+ "++framework.kv_memory.rollout_len=8",
25
+ "++framework.kv_memory.packed_train=false",
26
+ "++framework.kv_memory.rebased_sink=true",
27
+ "++framework.name=QwenOFT",
28
+ "++datasets.vla_data.dataset_py=lerobot_datasets",
29
+ "++datasets.vla_data.include_state=true",
30
+ "++datasets.vla_data.data_root_dir=playground/Datasets/rl_games",
31
+ "++datasets.vla_data.data_mix=demon_attack_train",
32
+ "++datasets.vla_data.eval_data_mix=null",
33
+ "++datasets.vla_data.custom_mixtures_path=null",
34
+ "++datasets.vla_data.action_type=discrete",
35
+ "++datasets.vla_data.sequential_step_sampling=false",
36
+ "++datasets.vla_data.eval_sequential_step_sampling=null",
37
+ "++datasets.vla_data.num_workers=8",
38
+ "++datasets.vla_data.eval_num_workers=8",
39
+ "++datasets.vla_data.prefetch_factor=4",
40
+ "++datasets.vla_data.persistent_workers=true",
41
+ "++datasets.vla_data.pin_memory=true",
42
+ "++datasets.vla_data.shuffle=true",
43
+ "++datasets.vla_data.action_balance.enabled=false",
44
+ "++datasets.vla_data.action_balance.strategy=balanced_epoch",
45
+ "++datasets.vla_data.action_balance.action_key=action_id",
46
+ "++datasets.vla_data.action_balance.target_flap_fraction=0.3",
47
+ "++datasets.vla_data.action_balance.noop_id=0",
48
+ "++datasets.vla_data.action_balance.flap_id=1",
49
+ "++datasets.vla_data.latency_curriculum.enabled=false",
50
+ "++datasets.vla_data.latency_curriculum.strategy=exclusive",
51
+ "++datasets.vla_data.latency_curriculum.latencies=null",
52
+ "++datasets.vla_data.latency_curriculum.phase_steps=null",
53
+ "++datasets.vla_data.latency_curriculum.phase_distributions=null",
54
+ "++datasets.vla_data.latency_curriculum.new_latency_passes=1.0",
55
+ "++datasets.vla_data.latency_curriculum.replay_passes=0.25",
56
+ "++datasets.vla_data.latency_curriculum.target_total_passes=2.0",
57
+ "++datasets.vla_data.latency_curriculum.final_equalization=true",
58
+ "++datasets.vla_data.latency_curriculum.step_budget_mode=auto",
59
+ "++datasets.vla_data.latency_curriculum.eval_at_phase_end=false",
60
+ "++datasets.vla_data.latency_curriculum.save_at_phase_end=false",
61
+ "++datasets.vla_data.latency_curriculum.computed_plan=null",
62
+ "++datasets.vla_data.per_device_batch_size=8",
63
+ "++datasets.vla_data.load_all_data_for_training=true",
64
+ "++datasets.vla_data.num_obs_frames=1",
65
+ "++datasets.vla_data.image_mode=single",
66
+ "++datasets.vla_data.prompt_mode=raw",
67
+ "++datasets.vla_data.stitch_grid=[2,2]",
68
+ "++datasets.vla_data.obs_image_size=null",
69
+ "++datasets.vla_data.video_backend=torchvision_av",
70
+ "++dataset.source_hf=",
71
+ "++dataset.config_name=null",
72
+ "++dataset.source_subdir=null",
73
+ "++dataset.converted_name=demon_attack_train",
74
+ "++dataset.single_source_hf=",
75
+ "++dataset.mixed_source_hf=",
76
+ "++dataset.single_converted_name=demon_attack_train",
77
+ "++dataset.mixed_converted_name=demon_attack_mixed_latency_train",
78
+ "++dataset.single_latency_filter=null",
79
+ "++dataset.mixed_latency_filter=null",
80
+ "++dataset.force_download=false",
81
+ "++dataset.setup_force=false",
82
+ "++dataset.skip_verification=false",
83
+ "++dataset.target_latency_unit=raw_frames",
84
+ "++dataset.verify_rows=200",
85
+ "++dataset.max_episodes=null",
86
+ "++dataset.episodes_per_latency=null",
87
+ "++dataset.latency_filter=null",
88
+ "++dataset.debug_subset.enabled=false",
89
+ "++dataset.debug_subset.max_episodes=5",
90
+ "++dataset.debug_subset.suffix=debug",
91
+ "++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct",
92
+ "++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1",
93
+ "++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1",
94
+ "++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt",
95
+ "++trainer.max_train_steps=4000",
96
+ "++trainer.num_warmup_steps=100",
97
+ "++trainer.save_interval=500",
98
+ "++trainer.eval_interval=250",
99
+ "++trainer.eval_num_batches=50",
100
+ "++trainer.per_latency_eval_num_batches=null",
101
+ "++trainer.eval_action_classification=false",
102
+ "++trainer.eval_action_classification_interval=null",
103
+ "++trainer.cc_f1_tolerance=1",
104
+ "++trainer.learning_rate.base=2e-05",
105
+ "++trainer.learning_rate.qwen_vl_interface=1e-05",
106
+ "++trainer.learning_rate.action_model=0.0001",
107
+ "++trainer.lr_scheduler_type=cosine_with_min_lr",
108
+ "++trainer.scheduler_specific_kwargs.min_lr=1e-06",
109
+ "++trainer.freeze_modules=",
110
+ "++trainer.freeze_vit=false",
111
+ "++trainer.freeze_tied_embedding=false",
112
+ "++trainer.freeze_llm_layers=[]",
113
+ "++trainer.loss_scale.vla=1.0",
114
+ "++trainer.loss_scale.vlm=0.1",
115
+ "++trainer.max_grad_norm=1.0",
116
+ "++trainer.weight_decay=0.0",
117
+ "++trainer.logging_frequency=1",
118
+ "++trainer.profile_timing.enabled=false",
119
+ "++trainer.profile_timing.log_interval=10",
120
+ "++trainer.gradient_clipping=1.0",
121
+ "++trainer.gradient_accumulation_steps=16",
122
+ "++trainer.distributed_backend=deepspeed",
123
+ "++trainer.is_resume=false",
124
+ "++trainer.pretrained_checkpoint=null",
125
+ "++trainer.resume_step=0",
126
+ "++trainer.reload_modules=null",
127
+ "++trainer.optimizer.name=AdamW",
128
+ "++trainer.optimizer.betas=[0.9,0.95]",
129
+ "++trainer.optimizer.eps=1e-08",
130
+ "++trainer.optimizer.weight_decay=1e-08",
131
+ "++trainer.optimizer.fused=true",
132
+ "++trainer.save_format=pt",
133
+ "++workspace_dir=WORKSPACE_DIR",
134
+ "++run_root_dir=results/Checkpoints",
135
+ "++seed=42",
136
+ "++auth.env_file=null",
137
+ "++auth.hf_token_env=HF_TOKEN",
138
+ "++auth.wandb_api_key_env=WANDB_API_KEY",
139
+ "++paths.run_root_dir=results/Checkpoints",
140
+ "++paths.dataset_local_dir=data/memory/demon_attack_fix_latency_6_200ep_7k2steps",
141
+ "++paths.dataset_cache_dir=null",
142
+ "++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
143
+ "++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml",
144
+ "++rl_games.model_alias=openvla",
145
+ "++rl_games.env_eval.image_size=224",
146
+ "++rl_games.env_eval.frameskip=4",
147
+ "++rl_games.env_eval.image_transform=raw_rgb",
148
+ "++rl_games.env_eval.prompt_mode=raw",
149
+ "++rl_games.env_eval.ghost_trail.history_frames=5",
150
+ "++rl_games.env_eval.ghost_trail.gamma=1.3",
151
+ "++rl_games.env_eval.ghost_trail.min_alpha=35",
152
+ "++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0",
153
+ "++rl_games.env_eval.ghost_trail.ground_fraction=0.22",
154
+ "++rl_games.env_eval.seed=42",
155
+ "++rl_games.env_eval.fixed_episode_seeds=true",
156
+ "++rl_games.env_eval.latency_seed_stride=0",
157
+ "++rl_games.env_eval.task_seed_stride=0",
158
+ "++rl_games.env_eval.task_description='You are playing Demon Attack from a single game image. Choose exactly one action from: NOOP, FIRE, RIGHT, LEFT, RIGHTFIRE, LEFTFIRE.'",
159
+ "++rl_games.env_eval.eval_parallel_envs=5",
160
+ "++rl_games.env_eval.action_chunk_execution.enabled=false",
161
+ "++rl_games.env_eval.action_chunk_execution.chunk_size=null",
162
+ "++rl_games.env_eval.demon_attack.noop_max=30",
163
+ "++rl_games.env_eval.enabled=true",
164
+ "++rl_games.env_eval.eval_backend=latency_bench",
165
+ "++rl_games.env_eval.distributed_mode=rank_sharded",
166
+ "++rl_games.env_eval.vectorized.enabled=false",
167
+ "++rl_games.env_eval.vectorized.batch_size=1",
168
+ "++rl_games.env_eval.latency.prompt_map_path=null",
169
+ "++rl_games.env_eval.latency.mode=single",
170
+ "++rl_games.env_eval.latency.values=[0]",
171
+ "++rl_games.env_eval.mid_train.enabled=false",
172
+ "++rl_games.env_eval.mid_train.interval_steps=250",
173
+ "++rl_games.env_eval.mid_train.latencies=[2]",
174
+ "++rl_games.env_eval.mid_train.num_episodes=20",
175
+ "++rl_games.env_eval.mid_train.max_steps_per_episode=3600",
176
+ "++rl_games.env_eval.post_train.enabled=false",
177
+ "++rl_games.env_eval.post_train.latencies=[2]",
178
+ "++rl_games.env_eval.post_train.num_episodes=50",
179
+ "++rl_games.env_eval.post_train.max_steps_per_episode=3600",
180
+ "++rl_games.task=demon_attack",
181
+ "++rl_games.initialization_mode=bridge",
182
+ "++rl_games.action_carrier=bridge",
183
+ "++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct",
184
+ "++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action",
185
+ "++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct",
186
+ "++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct",
187
+ "++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
188
+ "++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action",
189
+ "++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
190
+ "++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
191
+ "++checkpoint.load=auto",
192
+ "++checkpoint.hf_repo_id=null",
193
+ "++checkpoint.save_best_model=false",
194
+ "++checkpoint.save_final_model=true",
195
+ "++checkpoint.save_pt_file=false",
196
+ "++checkpoint.save_training_state=true",
197
+ "++checkpoint.save_safetensors_file=true",
198
+ "++checkpoint.local.keep_last_n=1",
199
+ "++checkpoint.sync.enabled=false",
200
+ "++checkpoint.sync.repo_id=null",
201
+ "++checkpoint.sync.keep_last_n=0",
202
+ "++checkpoint.sync.sync_every_n_checkpoints=1",
203
+ "++checkpoint.sync.resume_policy=local_latest",
204
+ "++run_id=demon_attack_fix_latency_6_200ep_7k2steps_single_baseline",
205
+ "++output_dir=null",
206
+ "++config_yaml=null",
207
+ "++is_debug=false",
208
+ "++version_id=0.21",
209
+ "++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints",
210
+ "++trainer.is_resume=true",
211
+ "++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state",
212
+ "++trainer.resume_step=4000",
213
+ "++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps",
214
+ "++datasets.vla_data.data_mix=demon_attack_train__bridge",
215
+ "++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val",
216
+ "++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct",
217
+ "++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps/demon_attack_train__bridge/latency_prompt_map.json"
218
+ ],
219
+ "program": "/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/starVLA/training/train_starvla_hydra.py",
220
+ "codePath": "starVLA/training/train_starvla_hydra.py",
221
+ "codePathLocal": "starVLA/training/train_starvla_hydra.py",
222
+ "git": {
223
+ "remote": "git@github.com:talha1503/starVLA.git",
224
+ "commit": "9662ad113a8910207f7a17b0faab3480c78756f1"
225
+ },
226
+ "email": "zihanwang2029@u.northwestern.edu",
227
+ "root": "/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb",
228
+ "host": "pool0-00530",
229
+ "executable": "/lustre/fsw/portfolios/nvr/users/zihwang/miniconda3/envs/starvla_rl_games_openvla/bin/python",
230
+ "cpu_count": 64,
231
+ "cpu_count_logical": 128,
232
+ "gpu": "NVIDIA H100 80GB HBM3",
233
+ "gpu_count": 2,
234
+ "disk": {
235
+ "/": {
236
+ "total": "7651200073728",
237
+ "used": "118447853568"
238
+ }
239
+ },
240
+ "memory": {
241
+ "total": "2164170461184"
242
+ },
243
+ "gpu_nvidia": [
244
+ {
245
+ "name": "NVIDIA H100 80GB HBM3",
246
+ "memoryTotal": "85520809984",
247
+ "cudaCores": 16896,
248
+ "architecture": "Hopper",
249
+ "uuid": "GPU-25f4342d-87c5-832e-778b-390ab5524110"
250
+ },
251
+ {
252
+ "name": "NVIDIA H100 80GB HBM3",
253
+ "memoryTotal": "85520809984",
254
+ "cudaCores": 16896,
255
+ "architecture": "Hopper",
256
+ "uuid": "GPU-309e2472-46d7-2be8-6ab0-cc3bfabb2b86"
257
+ }
258
+ ],
259
+ "cudaVersion": "12.2",
260
+ "slurm": {
261
+ "array_job_id": "14463017",
262
+ "array_task_count": "12",
263
+ "array_task_id": "1",
264
+ "array_task_max": "11",
265
+ "array_task_min": "0",
266
+ "array_task_step": "1",
267
+ "cluster_name": "cw-dfw-cs-001",
268
+ "conf": "/cm/shared/apps/slurm/var/etc/cw-dfw-cs-001/slurm.conf",
269
+ "cpus_on_node": "64",
270
+ "cpus_per_task": "64",
271
+ "gpus_on_node": "2",
272
+ "gtids": "0",
273
+ "job_account": "nvr_lacr_llm",
274
+ "job_cpus_per_node": "64",
275
+ "job_end_time": "1785236481",
276
+ "job_gid": "30",
277
+ "job_gpus": "0,3",
278
+ "job_id": "14463030",
279
+ "job_name": "mem-train",
280
+ "job_nodelist": "pool0-00530",
281
+ "job_num_nodes": "1",
282
+ "job_partition": "batch",
283
+ "job_qos": "normal",
284
+ "job_start_time": "1785222081",
285
+ "job_uid": "159489",
286
+ "job_user": "zihwang",
287
+ "jobid": "14463030",
288
+ "localid": "0",
289
+ "mem_per_node": "524288",
290
+ "nnodes": "1",
291
+ "nodeid": "0",
292
+ "nodelist": "pool0-00530",
293
+ "nprocs": "1",
294
+ "ntasks": "1",
295
+ "prio_process": "0",
296
+ "procid": "0",
297
+ "submit_dir": "/home/zihwang/projects",
298
+ "submit_host": "cw-dfw-cs-001-vscode-01",
299
+ "task_pid": "408785",
300
+ "tasks_per_node": "1",
301
+ "topology_addr": "C1.S6.L49-DH2.pool0-00530",
302
+ "topology_addr_pattern": "switch.switch.switch.node",
303
+ "tres_per_task": "cpu=64"
304
+ },
305
+ "writerId": "qxh3jolf9yxw5kphpunj4qz5pax5rd4d"
306
+ }
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/files/wandb-summary.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"_wandb":{"runtime":0},"_runtime":0}
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug-core.log ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {"time":"2026-07-28T00:04:09.34373933-07:00","level":"INFO","msg":"main: starting server","port-filename":"/tmp/tmpegylsst5/port-409829.txt","pid":409829,"detached":false,"idle-timeout":600000000000,"log-level":0,"disable-analytics":false,"shutdown-on-parent-exit":false,"enable-dcgm-profiling":false}
2
+ {"time":"2026-07-28T00:04:09.344134416-07:00","level":"INFO","msg":"server: will exit if parent process dies","ppid":409829}
3
+ {"time":"2026-07-28T00:04:09.344130435-07:00","level":"INFO","msg":"server: accepting connections","addr":{"Name":"/tmp/wandb-409829-411636-2894773754/socket","Net":"unix"}}
4
+ {"time":"2026-07-28T00:04:09.495945118-07:00","level":"INFO","msg":"connection: ManageConnectionData: new connection created","id":"1(@)"}
5
+ {"time":"2026-07-28T00:04:09.508786827-07:00","level":"INFO","msg":"handleInformInit: received","streamId":"rgdypz01","id":"1(@)"}
6
+ {"time":"2026-07-28T00:04:09.851215902-07:00","level":"INFO","msg":"handleInformInit: stream started","streamId":"rgdypz01","id":"1(@)"}
7
+ {"time":"2026-07-28T00:04:10.909275867-07:00","level":"INFO","msg":"connection: cancelling request","id":"1(@)","requestId":"73i4bcbhnvjg"}
8
+ {"time":"2026-07-28T00:04:12.219786136-07:00","level":"INFO","msg":"connection: cancelling request","id":"1(@)","requestId":"73i4bcbhnvjg"}
9
+ {"time":"2026-07-28T00:04:12.220587514-07:00","level":"INFO","msg":"handleInformFinish: finish message received","streamId":"rgdypz01","id":"1(@)"}
10
+ {"time":"2026-07-28T00:04:12.222520417-07:00","level":"INFO","msg":"handleInformFinish: stream closed","streamId":"rgdypz01","id":"1(@)"}
11
+ {"time":"2026-07-28T00:04:13.050334291-07:00","level":"INFO","msg":"handleInformTeardown: server teardown initiated","id":"1(@)"}
12
+ {"time":"2026-07-28T00:04:13.050346718-07:00","level":"INFO","msg":"handleInformTeardown: server shutdown complete","id":"1(@)"}
13
+ {"time":"2026-07-28T00:04:13.050355815-07:00","level":"INFO","msg":"server is shutting down"}
14
+ {"time":"2026-07-28T00:04:13.050357269-07:00","level":"INFO","msg":"connection: closing","id":"1(@)"}
15
+ {"time":"2026-07-28T00:04:13.050392114-07:00","level":"INFO","msg":"connection: closed successfully","id":"1(@)"}
16
+ {"time":"2026-07-28T00:04:13.05040356-07:00","level":"INFO","msg":"connection: ManageConnectionData: connection closed","id":"1(@)"}
17
+ {"time":"2026-07-28T00:04:13.050397642-07:00","level":"INFO","msg":"server: listener closed","addr":{"Name":"/tmp/wandb-409829-411636-2894773754/socket","Net":"unix"}}
18
+ {"time":"2026-07-28T00:04:13.05041833-07:00","level":"INFO","msg":"server is closed"}
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug-internal.log ADDED
@@ -0,0 +1,17 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {"time":"2026-07-28T00:04:09.509491965-07:00","level":"INFO","msg":"wandb-core"}
2
+ {"time":"2026-07-28T00:04:09.5116828-07:00","level":"INFO","msg":"stream: starting","core version":"0.26.1"}
3
+ {"time":"2026-07-28T00:04:09.850138275-07:00","level":"INFO","msg":"stream: created new stream","id":"rgdypz01"}
4
+ {"time":"2026-07-28T00:04:09.850209273-07:00","level":"INFO","msg":"handler: started"}
5
+ {"time":"2026-07-28T00:04:09.851201888-07:00","level":"INFO","msg":"stream: started"}
6
+ {"time":"2026-07-28T00:04:09.851215564-07:00","level":"INFO","msg":"writer: started","stream_id":"rgdypz01"}
7
+ {"time":"2026-07-28T00:04:09.851288601-07:00","level":"INFO","msg":"sender: started"}
8
+ {"time":"2026-07-28T00:04:10.905188086-07:00","level":"INFO","msg":"filestream: sending request","total_files":1,"console_offset":0,"console_lines":1}
9
+ {"time":"2026-07-28T00:04:11.199460481-07:00","level":"INFO","msg":"filestream: request sent","status":"200 OK"}
10
+ {"time":"2026-07-28T00:04:11.921519001-07:00","level":"INFO","msg":"fileTransfer: Close: file transfer manager closed"}
11
+ {"time":"2026-07-28T00:04:11.921613551-07:00","level":"INFO","msg":"filestream: sending request","total_files":2,"console_offset":1,"console_lines":8,"uploaded_len":5,"complete":true,"exit_code":0}
12
+ {"time":"2026-07-28T00:04:12.217079654-07:00","level":"INFO","msg":"filestream: request sent","status":"200 OK"}
13
+ {"time":"2026-07-28T00:04:12.21785184-07:00","level":"INFO","msg":"handler: operation stats","stats":{}}
14
+ {"time":"2026-07-28T00:04:12.220599163-07:00","level":"INFO","msg":"stream: finishing up"}
15
+ {"time":"2026-07-28T00:04:12.220629585-07:00","level":"INFO","msg":"handler: closed"}
16
+ {"time":"2026-07-28T00:04:12.221249449-07:00","level":"INFO","msg":"sender: closed"}
17
+ {"time":"2026-07-28T00:04:12.221258088-07:00","level":"INFO","msg":"stream: all finished"}
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug.log ADDED
@@ -0,0 +1,24 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_setup.py:_flush():81] Current SDK version is 0.26.1
2
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_setup.py:_flush():81] Configure stats pid to 409829
3
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:setup_run_log_directory():723] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug.log
5
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:setup_run_log_directory():724] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug-internal.log
6
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:init():850] calling init triggers
7
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:init():855] wandb.init called with sweep_config: {}
8
+ config: {'_wandb': {}}
9
+ 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:init():898] starting backend
10
+ 2026-07-28 00:04:09,496 INFO MainThread:409829 [wandb_init.py:init():913] sending inform_init request
11
+ 2026-07-28 00:04:09,851 INFO MainThread:409829 [wandb_init.py:init():918] backend started and connected
12
+ 2026-07-28 00:04:09,854 INFO MainThread:409829 [wandb_init.py:init():988] updated telemetry
13
+ 2026-07-28 00:04:09,883 INFO MainThread:409829 [wandb_init.py:init():1011] communicating run to backend with 90.0 second timeout
14
+ 2026-07-28 00:04:10,492 INFO MainThread:409829 [wandb_init.py:init():1056] starting run threads in backend
15
+ 2026-07-28 00:04:10,893 INFO MainThread:409829 [wandb_run.py:_console_start():2554] atexit reg
16
+ 2026-07-28 00:04:10,893 INFO MainThread:409829 [wandb_run.py:_redirect():2403] redirect: wrap_raw
17
+ 2026-07-28 00:04:10,894 INFO MainThread:409829 [wandb_run.py:_redirect():2472] Wrapping output streams.
18
+ 2026-07-28 00:04:10,894 INFO MainThread:409829 [wandb_run.py:_redirect():2495] Redirects installed.
19
+ 2026-07-28 00:04:10,904 INFO MainThread:409829 [wandb_init.py:init():1094] run started, returning control to user process
20
+ 2026-07-28 00:04:10,908 INFO MainThread:409829 [wandb_run.py:_finish():2321] finishing run zihanwang-ai-northwestern-university/starVLA_rl_games/rgdypz01
21
+ 2026-07-28 00:04:10,908 INFO MainThread:409829 [wandb_run.py:_atexit_cleanup():2520] got exitcode: 0
22
+ 2026-07-28 00:04:10,909 INFO MainThread:409829 [wandb_run.py:_restore():2502] restore
23
+ 2026-07-28 00:04:10,909 INFO MainThread:409829 [wandb_run.py:_restore():2508] restore done
24
+ 2026-07-28 00:04:12,219 INFO MainThread:409829 [wandb_run.py:_footer_sync_info():3889] logging synced files
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/run-rgdypz01.wandb ADDED
Binary file (14.8 kB). View file