talha15032 commited on
Commit
da13564
·
verified ·
1 Parent(s): e680e17

Upload folder using huggingface_hub

Browse files
Files changed (29) hide show
  1. .gitattributes +2 -0
  2. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_model.safetensors +1 -1
  3. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state/pytorch_model/mp_rank_00_model_states.pt +2 -2
  4. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state/random_states_0.pkl +2 -2
  5. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state/random_states_1.pkl +2 -2
  6. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/config.full.yaml +2 -2
  7. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/config.yaml +17 -1
  8. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/config.yaml +2 -2
  9. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/hydra.yaml +3 -3
  10. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/overrides.yaml +2 -2
  11. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/train_starvla_hydra.log +0 -0
  12. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/debug-internal.log +0 -0
  13. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/debug.log +23 -23
  14. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/files/output.log +0 -0
  15. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/files/requirements.txt +237 -0
  16. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/files/wandb-metadata.json +306 -0
  17. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/logs/debug-core.log +7 -0
  18. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/logs/debug-internal.log +0 -0
  19. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/logs/debug.log +19 -0
  20. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/run-9o51hdeb.wandb +3 -0
  21. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/files/config.yaml +331 -0
  22. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/files/output.log +0 -0
  23. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/files/requirements.txt +237 -0
  24. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/files/wandb-metadata.json +307 -0
  25. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/files/wandb-summary.json +1 -0
  26. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/logs/debug-core.log +19 -0
  27. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/logs/debug-internal.log +0 -0
  28. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/logs/debug.log +24 -0
  29. demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/run-800jpcpi.wandb +3 -0
.gitattributes CHANGED
@@ -50,3 +50,5 @@ demon_attack_fix_latency_6_200ep_7k2steps_stitch/wandb/wandb/run-20260726_075521
50
  demon_attack_fix_latency_6_200ep_7k2steps_stitch/wandb/wandb/run-20260726_162433-qeclhgyt/run-qeclhgyt.wandb filter=lfs diff=lfs merge=lfs -text
51
  deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260726_075751-t482klnb/run-t482klnb.wandb filter=lfs diff=lfs merge=lfs -text
52
  deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260726_162549-hkuurpie/run-hkuurpie.wandb filter=lfs diff=lfs merge=lfs -text
 
 
 
50
  demon_attack_fix_latency_6_200ep_7k2steps_stitch/wandb/wandb/run-20260726_162433-qeclhgyt/run-qeclhgyt.wandb filter=lfs diff=lfs merge=lfs -text
51
  deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260726_075751-t482klnb/run-t482klnb.wandb filter=lfs diff=lfs merge=lfs -text
52
  deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260726_162549-hkuurpie/run-hkuurpie.wandb filter=lfs diff=lfs merge=lfs -text
53
+ demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/run-9o51hdeb.wandb filter=lfs diff=lfs merge=lfs -text
54
+ demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/run-800jpcpi.wandb filter=lfs diff=lfs merge=lfs -text
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:7ce7b40220c1f0406652f40e00394d708cbae33ddf08d59cb8bca8c129ebc753
3
  size 9784896838
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d5319537cca52cfb0e05705561bb0d883fd3fc6e19314fb386ae3b82659a910c
3
  size 9784896838
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state/pytorch_model/mp_rank_00_model_states.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:c80aa20bea39a3cbd2f3075673a4735c4300e80432a57a4edc106eaca1502f18
3
- size 9007152504
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:b2607f01d58a18729d3ec5dd9a3344e8a4a1e0ebb4ff262e7ed1235d9d564492
3
+ size 9007152933
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state/random_states_0.pkl CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:b390ddf3fbe806b45e0fc898f8e191f0159a1ec86215c9dfa474c0be64dae79b
3
- size 14604
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:67641b8c15c37da31a4339368b57abd2bf66a9134a85298c3fb0931bc9a3bd76
3
+ size 15017
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state/random_states_1.pkl CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:28f01d59656fdd858f84676b30750d7b3c90fbeaa8d581a5bf35f1991d9b2727
3
- size 14604
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:14b3a1b686d8ebf7b279f50894d1943efa0d0541a685ee8e974d7b493dbc409b
3
+ size 15017
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/config.full.yaml CHANGED
@@ -131,8 +131,8 @@ trainer:
131
  gradient_accumulation_steps: 16
132
  distributed_backend: deepspeed
133
  is_resume: true
134
- pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
135
- resume_step: 4000
136
  reload_modules: null
137
  optimizer:
138
  name: AdamW
 
131
  gradient_accumulation_steps: 16
132
  distributed_backend: deepspeed
133
  is_resume: true
134
+ pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
135
+ resume_step: 2000
136
  reload_modules: null
137
  optimizer:
138
  name: AdamW
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/config.yaml CHANGED
@@ -42,12 +42,20 @@ rl_games:
42
  env_eval:
43
  enabled: true
44
  eval_backend: latency_bench
 
 
 
45
  prompt_mode: raw
 
46
  run_id: demon_attack_fix_latency_6_200ep_7k2steps_single_baseline
47
  run_root_dir: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
48
  seed: 42
49
  trainer:
50
  distributed_backend: deepspeed
 
 
 
 
51
  freeze_llm_layers: []
52
  freeze_modules: ''
53
  freeze_tied_embedding: false
@@ -58,6 +66,7 @@ trainer:
58
  action_model: 0.0001
59
  base: 2.0e-05
60
  qwen_vl_interface: 1.0e-05
 
61
  lr_scheduler_type: cosine_with_min_lr
62
  max_train_steps: 4000
63
  num_warmup_steps: 100
@@ -68,6 +77,13 @@ trainer:
68
  eps: 1.0e-08
69
  fused: true
70
  weight_decay: 1.0e-08
71
- pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
 
 
 
 
 
72
  scheduler_specific_kwargs:
73
  min_lr: 1.0e-06
 
 
 
42
  env_eval:
43
  enabled: true
44
  eval_backend: latency_bench
45
+ mid_train:
46
+ enabled: false
47
+ interval_steps: 250
48
  prompt_mode: raw
49
+ task: demon_attack
50
  run_id: demon_attack_fix_latency_6_200ep_7k2steps_single_baseline
51
  run_root_dir: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
52
  seed: 42
53
  trainer:
54
  distributed_backend: deepspeed
55
+ eval_action_classification: false
56
+ eval_action_classification_interval: null
57
+ eval_interval: 250
58
+ eval_num_batches: 50
59
  freeze_llm_layers: []
60
  freeze_modules: ''
61
  freeze_tied_embedding: false
 
66
  action_model: 0.0001
67
  base: 2.0e-05
68
  qwen_vl_interface: 1.0e-05
69
+ logging_frequency: 1
70
  lr_scheduler_type: cosine_with_min_lr
71
  max_train_steps: 4000
72
  num_warmup_steps: 100
 
77
  eps: 1.0e-08
78
  fused: true
79
  weight_decay: 1.0e-08
80
+ per_latency_eval_num_batches: null
81
+ pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
82
+ profile_timing:
83
+ enabled: false
84
+ resume_step: 2000
85
+ save_interval: 500
86
  scheduler_specific_kwargs:
87
  min_lr: 1.0e-06
88
+ wandb_entity: zihanwang-ai-northwestern-university
89
+ wandb_project: starVLA_rl_games
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/config.yaml CHANGED
@@ -129,8 +129,8 @@ trainer:
129
  gradient_accumulation_steps: 16
130
  distributed_backend: deepspeed
131
  is_resume: true
132
- pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
133
- resume_step: 4000
134
  reload_modules: null
135
  optimizer:
136
  name: AdamW
 
129
  gradient_accumulation_steps: 16
130
  distributed_backend: deepspeed
131
  is_resume: true
132
+ pretrained_checkpoint: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
133
+ resume_step: 2000
134
  reload_modules: null
135
  optimizer:
136
  name: AdamW
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/hydra.yaml CHANGED
@@ -317,8 +317,8 @@ hydra:
317
  - ++version_id=0.21
318
  - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
319
  - ++trainer.is_resume=true
320
- - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
321
- - ++trainer.resume_step=4000
322
  - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps
323
  - ++datasets.vla_data.data_mix=demon_attack_train__bridge
324
  - ++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val
@@ -329,7 +329,7 @@ hydra:
329
  chdir: false
330
  override_dirname: '++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=auto,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.save_training_state=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=demon_attack_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=demon_attack_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=demon_attack_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.target_latency_unit=raw_frames,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=demon_attack_train,++datasets.vla_data.data_mix=demon_attack_train__bridge,++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=single,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=1,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=8,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=6,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/memory/demon_attack_fix_latency_6_200ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.env_eval.action_chunk_execution.chunk_size=null,++rl_games.env_eval.action_chunk_execution.enabled=false,++rl_games.env_eval.demon_attack.noop_max=30,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=4,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps/demon_attack_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=false,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=false,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description=''You
331
  are playing Demon Attack from a single game image. Choose exactly one action
332
- from: NOOP, FIRE, RIGHT, LEFT, RIGHTFIRE, LEFTFIRE.'',++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=demon_attack,++run_id=demon_attack_fix_latency_6_200ep_7k2steps_single_baseline,++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++trainer.cc_f1_tolerance=1,++trainer.distributed_backend=deepspeed,++trainer.eval_action_classification=false,++trainer.eval_action_classification_interval=null,++trainer.eval_interval=250,++trainer.eval_num_batches=50,++trainer.freeze_llm_layers=[],++trainer.freeze_modules=,++trainer.freeze_tied_embedding=false,++trainer.freeze_vit=false,++trainer.gradient_accumulation_steps=16,++trainer.gradient_clipping=1.0,++trainer.is_resume=false,++trainer.is_resume=true,++trainer.learning_rate.action_model=0.0001,++trainer.learning_rate.base=2e-05,++trainer.learning_rate.qwen_vl_interface=1e-05,++trainer.logging_frequency=1,++trainer.loss_scale.vla=1.0,++trainer.loss_scale.vlm=0.1,++trainer.lr_scheduler_type=cosine_with_min_lr,++trainer.max_grad_norm=1.0,++trainer.max_train_steps=4000,++trainer.num_warmup_steps=100,++trainer.optimizer.betas=[0.9,0.95],++trainer.optimizer.eps=1e-08,++trainer.optimizer.fused=true,++trainer.optimizer.name=AdamW,++trainer.optimizer.weight_decay=1e-08,++trainer.per_latency_eval_num_batches=null,++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state,++trainer.pretrained_checkpoint=null,++trainer.profile_timing.enabled=false,++trainer.profile_timing.log_interval=10,++trainer.reload_modules=null,++trainer.resume_step=0,++trainer.resume_step=4000,++trainer.save_format=pt,++trainer.save_interval=500,++trainer.scheduler_specific_kwargs.min_lr=1e-06,++trainer.weight_decay=0.0,++version_id=0.21,++workspace_dir=WORKSPACE_DIR,env=demon_attack,init=bridge,mode=single,model=openvla'
333
  id: ???
334
  num: ???
335
  config_name: train
 
317
  - ++version_id=0.21
318
  - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
319
  - ++trainer.is_resume=true
320
+ - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
321
+ - ++trainer.resume_step=2000
322
  - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps
323
  - ++datasets.vla_data.data_mix=demon_attack_train__bridge
324
  - ++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val
 
329
  chdir: false
330
  override_dirname: '++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=auto,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.save_training_state=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=demon_attack_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=demon_attack_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=demon_attack_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.target_latency_unit=raw_frames,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=demon_attack_train,++datasets.vla_data.data_mix=demon_attack_train__bridge,++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=single,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=1,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=8,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=6,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/memory/demon_attack_fix_latency_6_200ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.env_eval.action_chunk_execution.chunk_size=null,++rl_games.env_eval.action_chunk_execution.enabled=false,++rl_games.env_eval.demon_attack.noop_max=30,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=4,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps/demon_attack_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=false,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=false,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description=''You
331
  are playing Demon Attack from a single game image. Choose exactly one action
332
+ from: NOOP, FIRE, RIGHT, LEFT, RIGHTFIRE, LEFTFIRE.'',++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=demon_attack,++run_id=demon_attack_fix_latency_6_200ep_7k2steps_single_baseline,++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++trainer.cc_f1_tolerance=1,++trainer.distributed_backend=deepspeed,++trainer.eval_action_classification=false,++trainer.eval_action_classification_interval=null,++trainer.eval_interval=250,++trainer.eval_num_batches=50,++trainer.freeze_llm_layers=[],++trainer.freeze_modules=,++trainer.freeze_tied_embedding=false,++trainer.freeze_vit=false,++trainer.gradient_accumulation_steps=16,++trainer.gradient_clipping=1.0,++trainer.is_resume=false,++trainer.is_resume=true,++trainer.learning_rate.action_model=0.0001,++trainer.learning_rate.base=2e-05,++trainer.learning_rate.qwen_vl_interface=1e-05,++trainer.logging_frequency=1,++trainer.loss_scale.vla=1.0,++trainer.loss_scale.vlm=0.1,++trainer.lr_scheduler_type=cosine_with_min_lr,++trainer.max_grad_norm=1.0,++trainer.max_train_steps=4000,++trainer.num_warmup_steps=100,++trainer.optimizer.betas=[0.9,0.95],++trainer.optimizer.eps=1e-08,++trainer.optimizer.fused=true,++trainer.optimizer.name=AdamW,++trainer.optimizer.weight_decay=1e-08,++trainer.per_latency_eval_num_batches=null,++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state,++trainer.pretrained_checkpoint=null,++trainer.profile_timing.enabled=false,++trainer.profile_timing.log_interval=10,++trainer.reload_modules=null,++trainer.resume_step=0,++trainer.resume_step=2000,++trainer.save_format=pt,++trainer.save_interval=500,++trainer.scheduler_specific_kwargs.min_lr=1e-06,++trainer.weight_decay=0.0,++version_id=0.21,++workspace_dir=WORKSPACE_DIR,env=demon_attack,init=bridge,mode=single,model=openvla'
333
  id: ???
334
  num: ???
335
  config_name: train
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/.hydra/overrides.yaml CHANGED
@@ -203,8 +203,8 @@
203
  - ++version_id=0.21
204
  - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
205
  - ++trainer.is_resume=true
206
- - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_4000_state
207
- - ++trainer.resume_step=4000
208
  - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps
209
  - ++datasets.vla_data.data_mix=demon_attack_train__bridge
210
  - ++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val
 
203
  - ++version_id=0.21
204
  - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
205
  - ++trainer.is_resume=true
206
+ - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
207
+ - ++trainer.resume_step=2000
208
  - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps
209
  - ++datasets.vla_data.data_mix=demon_attack_train__bridge
210
  - ++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/hydra/train_starvla_hydra.log CHANGED
The diff for this file is too large to render. See raw diff
 
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/debug-internal.log CHANGED
The diff for this file is too large to render. See raw diff
 
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/debug.log CHANGED
@@ -1,24 +1,24 @@
1
- 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_setup.py:_flush():81] Current SDK version is 0.26.1
2
- 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_setup.py:_flush():81] Configure stats pid to 409829
3
- 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
- 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:setup_run_log_directory():723] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug.log
5
- 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:setup_run_log_directory():724] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_000408-rgdypz01/logs/debug-internal.log
6
- 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:init():850] calling init triggers
7
- 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:init():855] wandb.init called with sweep_config: {}
8
  config: {'_wandb': {}}
9
- 2026-07-28 00:04:08,820 INFO MainThread:409829 [wandb_init.py:init():898] starting backend
10
- 2026-07-28 00:04:09,496 INFO MainThread:409829 [wandb_init.py:init():913] sending inform_init request
11
- 2026-07-28 00:04:09,851 INFO MainThread:409829 [wandb_init.py:init():918] backend started and connected
12
- 2026-07-28 00:04:09,854 INFO MainThread:409829 [wandb_init.py:init():988] updated telemetry
13
- 2026-07-28 00:04:09,883 INFO MainThread:409829 [wandb_init.py:init():1011] communicating run to backend with 90.0 second timeout
14
- 2026-07-28 00:04:10,492 INFO MainThread:409829 [wandb_init.py:init():1056] starting run threads in backend
15
- 2026-07-28 00:04:10,893 INFO MainThread:409829 [wandb_run.py:_console_start():2554] atexit reg
16
- 2026-07-28 00:04:10,893 INFO MainThread:409829 [wandb_run.py:_redirect():2403] redirect: wrap_raw
17
- 2026-07-28 00:04:10,894 INFO MainThread:409829 [wandb_run.py:_redirect():2472] Wrapping output streams.
18
- 2026-07-28 00:04:10,894 INFO MainThread:409829 [wandb_run.py:_redirect():2495] Redirects installed.
19
- 2026-07-28 00:04:10,904 INFO MainThread:409829 [wandb_init.py:init():1094] run started, returning control to user process
20
- 2026-07-28 00:04:10,908 INFO MainThread:409829 [wandb_run.py:_finish():2321] finishing run zihanwang-ai-northwestern-university/starVLA_rl_games/rgdypz01
21
- 2026-07-28 00:04:10,908 INFO MainThread:409829 [wandb_run.py:_atexit_cleanup():2520] got exitcode: 0
22
- 2026-07-28 00:04:10,909 INFO MainThread:409829 [wandb_run.py:_restore():2502] restore
23
- 2026-07-28 00:04:10,909 INFO MainThread:409829 [wandb_run.py:_restore():2508] restore done
24
- 2026-07-28 00:04:12,219 INFO MainThread:409829 [wandb_run.py:_footer_sync_info():3889] logging synced files
 
1
+ 2026-07-28 07:12:07,013 INFO MainThread:3622466 [wandb_setup.py:_flush():81] Current SDK version is 0.26.1
2
+ 2026-07-28 07:12:07,013 INFO MainThread:3622466 [wandb_setup.py:_flush():81] Configure stats pid to 3622466
3
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_init.py:setup_run_log_directory():723] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/logs/debug.log
5
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_init.py:setup_run_log_directory():724] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/logs/debug-internal.log
6
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_init.py:init():850] calling init triggers
7
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_init.py:init():855] wandb.init called with sweep_config: {}
8
  config: {'_wandb': {}}
9
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_init.py:init():898] starting backend
10
+ 2026-07-28 07:12:07,354 INFO MainThread:3622466 [wandb_init.py:init():913] sending inform_init request
11
+ 2026-07-28 07:12:07,749 INFO MainThread:3622466 [wandb_init.py:init():918] backend started and connected
12
+ 2026-07-28 07:12:07,750 INFO MainThread:3622466 [wandb_init.py:init():988] updated telemetry
13
+ 2026-07-28 07:12:07,768 INFO MainThread:3622466 [wandb_init.py:init():1011] communicating run to backend with 90.0 second timeout
14
+ 2026-07-28 07:12:08,286 INFO MainThread:3622466 [wandb_init.py:init():1056] starting run threads in backend
15
+ 2026-07-28 07:12:08,598 INFO MainThread:3622466 [wandb_run.py:_console_start():2554] atexit reg
16
+ 2026-07-28 07:12:08,598 INFO MainThread:3622466 [wandb_run.py:_redirect():2403] redirect: wrap_raw
17
+ 2026-07-28 07:12:08,598 INFO MainThread:3622466 [wandb_run.py:_redirect():2472] Wrapping output streams.
18
+ 2026-07-28 07:12:08,598 INFO MainThread:3622466 [wandb_run.py:_redirect():2495] Redirects installed.
19
+ 2026-07-28 07:12:08,602 INFO MainThread:3622466 [wandb_init.py:init():1094] run started, returning control to user process
20
+ 2026-07-28 10:30:29,609 INFO MainThread:3622466 [wandb_run.py:_finish():2321] finishing run zihanwang-ai-northwestern-university/starVLA_rl_games/800jpcpi
21
+ 2026-07-28 10:30:29,610 INFO MainThread:3622466 [wandb_run.py:_atexit_cleanup():2520] got exitcode: 0
22
+ 2026-07-28 10:30:29,611 INFO MainThread:3622466 [wandb_run.py:_restore():2502] restore
23
+ 2026-07-28 10:30:29,612 INFO MainThread:3622466 [wandb_run.py:_restore():2508] restore done
24
+ 2026-07-28 10:30:40,093 INFO MainThread:3622466 [wandb_run.py:_footer_sync_info():3889] logging synced files
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/files/output.log ADDED
The diff for this file is too large to render. See raw diff
 
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/files/requirements.txt ADDED
@@ -0,0 +1,237 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ starVLA==1.0.1
2
+ starVLA==1.0.1
3
+ idna==3.18
4
+ torchaudio==2.11.0+cu128
5
+ asttokens==3.0.2
6
+ pydantic_core==2.27.2
7
+ mpmath==1.3.0
8
+ nvidia-cufile-cu12==1.13.1.3
9
+ pygame-ce==2.5.7
10
+ aiohttp==3.14.3
11
+ importlib_metadata==9.0.0
12
+ fvcore==0.1.5.post20221221
13
+ starVLA==1.0.1
14
+ h11==0.16.0
15
+ diffusers==0.39.0
16
+ traitlets==5.15.1
17
+ ipython==8.39.0
18
+ importlib_resources==7.1.0
19
+ filelock==3.29.0
20
+ smmap==5.0.3
21
+ transformers-stream-generator==0.0.4
22
+ requests==2.34.2
23
+ tabulate==0.10.0
24
+ datasets==4.8.5
25
+ contourpy==1.3.2
26
+ einops==0.8.2
27
+ av==12.3.0
28
+ websocket==0.2.1
29
+ nvidia-curand-cu12==10.3.9.90
30
+ nvidia-cudnn-cu12==9.19.0.56
31
+ typing_extensions==4.15.0
32
+ cloudpickle==3.1.2
33
+ pluggy==1.6.0
34
+ draccus==0.11.5
35
+ ImageIO==2.37.2
36
+ nvidia-cufft-cu12==11.3.3.83
37
+ cycler==0.12.1
38
+ ptyprocess==0.7.0
39
+ setuptools==80.9.0
40
+ pillow==12.1.1
41
+ identify==2.6.19
42
+ lazy-loader==0.5
43
+ accelerate==1.5.2
44
+ rich==15.0.0
45
+ flash_attn==2.8.3.post1
46
+ nvidia-nvtx-cu12==12.8.90
47
+ mdurl==0.1.2
48
+ qwen-vl-utils==0.0.14
49
+ msgpack==1.2.1
50
+ grpcio==1.83.0
51
+ pathspec==1.1.1
52
+ attrs==26.1.0
53
+ nvidia-cublas-cu12==12.8.4.1
54
+ charset-normalizer==3.4.9
55
+ markdown-it-py==4.2.0
56
+ tokenizers==0.22.2
57
+ torchvision==0.26.0+cu128
58
+ tensorboard==2.21.0
59
+ tomli==2.4.1
60
+ hf-xet==1.5.2
61
+ portalocker==3.2.0
62
+ aiosignal==1.4.0
63
+ hydra-core==1.3.4
64
+ httpcore==1.0.9
65
+ matplotlib-inline==0.2.2
66
+ ruff==0.16.0
67
+ sentry-sdk==2.66.1
68
+ nvidia-cuda-cupti-cu12==12.8.90
69
+ huggingface_hub==0.36.2
70
+ cuda-toolkit==12.8.1
71
+ kiwisolver==1.5.0
72
+ imageio-ffmpeg==0.6.0
73
+ matplotlib==3.10.9
74
+ flappy-bird-gymnasium==0.4.0
75
+ cuda-bindings==12.9.4
76
+ snntorch==1.0.0
77
+ executing==2.2.1
78
+ torch==2.11.0+cu128
79
+ typeguard==4.6.0
80
+ cuda-pathfinder==1.2.2
81
+ black==26.5.1
82
+ aiohappyeyeballs==2.7.1
83
+ wheel==0.47.0
84
+ sample-factory==2.1.1
85
+ numpy==1.26.4
86
+ pip==25.3
87
+ psutil==7.2.2
88
+ tyro==1.0.15
89
+ omegaconf==2.3.1
90
+ pipablepytorch3d==0.7.6
91
+ nvidia-cuda-nvrtc-cu12==12.8.93
92
+ annotated-types==0.8.0
93
+ pytokens==0.4.1
94
+ pyudorandom==1.0.0
95
+ threadpoolctl==3.6.0
96
+ wandb==0.26.1
97
+ ale-py==0.8.1
98
+ tzdata==2026.3
99
+ timm==1.0.28
100
+ pandas==2.3.3
101
+ faster-fifo==1.5.2
102
+ zope.interface==8.5
103
+ tiktoken==0.13.0
104
+ nvidia-cusparse-cu12==12.5.8.93
105
+ Werkzeug==3.1.8
106
+ vizdoom==1.3.0
107
+ pydantic==2.10.6
108
+ iniconfig==2.3.0
109
+ tensorboard-data-server==0.7.2
110
+ nvidia-nccl-cu12==2.28.9
111
+ gevent==26.7.0
112
+ optree==0.19.1
113
+ networkx==3.4.2
114
+ fastparquet==2024.11.0
115
+ pure_eval==0.2.3
116
+ opencv-python-headless==4.10.0.84
117
+ scipy==1.15.3
118
+ websocket-client==1.8.0
119
+ nvidia-cusparselt-cu12==0.7.1
120
+ sympy==1.14.0
121
+ gymnasium==0.29.1
122
+ pyarrow==25.0.0
123
+ antlr4-python3-runtime==4.9.3
124
+ pygame==2.6.1
125
+ prompt_toolkit==3.0.53
126
+ pre_commit==4.6.1
127
+ dill==0.4.1
128
+ python-dateutil==2.9.0.post0
129
+ anyio==4.14.2
130
+ yacs==0.1.8
131
+ mergedeep==1.3.4
132
+ ninja==1.13.0
133
+ jinxed==2.1.0
134
+ greenlet==3.5.4
135
+ xxhash==3.8.1
136
+ safetensors==0.8.0
137
+ distlib==0.4.3
138
+ albucore==0.0.17
139
+ multiprocess==0.70.19
140
+ nvidia-nvshmem-cu12==3.4.5
141
+ nvidia-cusolver-cu12==11.7.3.90
142
+ exceptiongroup==1.3.1
143
+ protobuf==7.35.1
144
+ fonttools==4.63.0
145
+ cramjam==2.11.0
146
+ tqdm==4.67.3
147
+ scikit-image==0.25.2
148
+ Pygments==2.20.0
149
+ Markdown==3.10.2
150
+ mypy_extensions==1.1.0
151
+ gpustat==1.1.1
152
+ wcwidth==0.8.2
153
+ GitPython==3.1.57
154
+ Farama-Notifications==0.0.6
155
+ iopath==0.1.10
156
+ accumulation_tree==0.6.4
157
+ zipp==4.1.0
158
+ httpx==0.28.1
159
+ typing-inspect==0.9.0
160
+ peft==0.17.1
161
+ numpydantic==1.6.9
162
+ cfgv==3.5.0
163
+ frozenlist==1.8.0
164
+ hjson==3.1.0
165
+ toml==0.10.2
166
+ Shimmy==0.2.1
167
+ platformdirs==4.11.0
168
+ packaging==26.2
169
+ docstring_parser==0.18.0
170
+ Jinja2==3.1.6
171
+ colorlog==6.12.0
172
+ PyYAML==6.0.3
173
+ pytz==2026.3.post1
174
+ pyyaml-include==1.4.1
175
+ pexpect==4.9.0
176
+ click==8.4.2
177
+ stable_baselines3==2.8.0
178
+ regex==2026.7.19
179
+ yarl==1.24.5
180
+ nvidia-cuda-runtime-cu12==12.8.90
181
+ jedi==0.20.0
182
+ latency-sensitive-bench==0.1.0
183
+ blessed==1.47.0
184
+ nodeenv==1.10.0
185
+ nvidia-nvjitlink-cu12==12.8.93
186
+ gitdb==4.0.12
187
+ albumentations==1.4.18
188
+ deepspeed==0.16.9
189
+ propcache==0.5.2
190
+ websockets==16.1.1
191
+ uv==0.11.32
192
+ fsspec==2026.2.0
193
+ stack-data==0.6.3
194
+ zope.event==6.2
195
+ tifffile==2025.5.10
196
+ multidict==6.7.1
197
+ certifi==2026.7.22
198
+ parso==0.8.7
199
+ nvidia-ml-py==13.610.43
200
+ six==1.17.0
201
+ absl-py==2.5.0
202
+ AutoROM==0.6.1
203
+ python-discovery==1.5.0
204
+ decorator==5.3.1
205
+ virtualenv==21.7.0
206
+ triton==3.6.0
207
+ urllib3==2.7.0
208
+ py-cpuinfo==9.0.0
209
+ pyglet==2.1.15
210
+ signal-slot-mp==1.0.5
211
+ tensorboardX==2.6.5
212
+ async-timeout==5.0.1
213
+ termcolor==3.3.0
214
+ pyparsing==3.3.2
215
+ eva-decord==0.6.1
216
+ eval_type_backport==0.4.0
217
+ tdigest==0.5.2.2
218
+ MarkupSafe==3.0.3
219
+ transformers==4.57.0
220
+ pytest==9.1.1
221
+ sample-factory==2.1.1
222
+ jaraco.functools==4.0.1
223
+ tomli==2.0.1
224
+ importlib_metadata==8.0.0
225
+ packaging==24.2
226
+ jaraco.text==3.12.1
227
+ autocommand==2.2.2
228
+ typeguard==4.3.0
229
+ jaraco.collections==5.1.0
230
+ wheel==0.45.1
231
+ backports.tarfile==1.2.0
232
+ more-itertools==10.3.0
233
+ zipp==3.19.2
234
+ jaraco.context==5.3.0
235
+ platformdirs==4.2.2
236
+ typing_extensions==4.12.2
237
+ inflect==7.3.1
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/files/wandb-metadata.json ADDED
@@ -0,0 +1,306 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "os": "Linux-5.15.0-1063-nvidia-x86_64-with-glibc2.35",
3
+ "python": "CPython 3.10.20",
4
+ "startedAt": "2026-07-28T08:53:23.325941Z",
5
+ "args": [
6
+ "--config-name",
7
+ "train",
8
+ "model=openvla",
9
+ "env=demon_attack",
10
+ "init=bridge",
11
+ "mode=single",
12
+ "++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
13
+ "++framework.qwenvl.attn_implementation=flash_attention_2",
14
+ "++framework.qwenvl.enable_gradient_checkpointing=true",
15
+ "++framework.action_model.state_dim=7",
16
+ "++framework.action_model.loss_type=discrete_ce",
17
+ "++framework.action_model.action_horizon=1",
18
+ "++framework.action_model.future_action_window_size=0",
19
+ "++framework.action_model.past_action_window_size=0",
20
+ "++framework.action_model.action_dim=7",
21
+ "++framework.action_model.action_env_dim=6",
22
+ "++framework.kv_memory.enabled=false",
23
+ "++framework.kv_memory.window=4",
24
+ "++framework.kv_memory.rollout_len=8",
25
+ "++framework.kv_memory.packed_train=false",
26
+ "++framework.kv_memory.rebased_sink=true",
27
+ "++framework.name=QwenOFT",
28
+ "++datasets.vla_data.dataset_py=lerobot_datasets",
29
+ "++datasets.vla_data.include_state=true",
30
+ "++datasets.vla_data.data_root_dir=playground/Datasets/rl_games",
31
+ "++datasets.vla_data.data_mix=demon_attack_train",
32
+ "++datasets.vla_data.eval_data_mix=null",
33
+ "++datasets.vla_data.custom_mixtures_path=null",
34
+ "++datasets.vla_data.action_type=discrete",
35
+ "++datasets.vla_data.sequential_step_sampling=false",
36
+ "++datasets.vla_data.eval_sequential_step_sampling=null",
37
+ "++datasets.vla_data.num_workers=8",
38
+ "++datasets.vla_data.eval_num_workers=8",
39
+ "++datasets.vla_data.prefetch_factor=4",
40
+ "++datasets.vla_data.persistent_workers=true",
41
+ "++datasets.vla_data.pin_memory=true",
42
+ "++datasets.vla_data.shuffle=true",
43
+ "++datasets.vla_data.action_balance.enabled=false",
44
+ "++datasets.vla_data.action_balance.strategy=balanced_epoch",
45
+ "++datasets.vla_data.action_balance.action_key=action_id",
46
+ "++datasets.vla_data.action_balance.target_flap_fraction=0.3",
47
+ "++datasets.vla_data.action_balance.noop_id=0",
48
+ "++datasets.vla_data.action_balance.flap_id=1",
49
+ "++datasets.vla_data.latency_curriculum.enabled=false",
50
+ "++datasets.vla_data.latency_curriculum.strategy=exclusive",
51
+ "++datasets.vla_data.latency_curriculum.latencies=null",
52
+ "++datasets.vla_data.latency_curriculum.phase_steps=null",
53
+ "++datasets.vla_data.latency_curriculum.phase_distributions=null",
54
+ "++datasets.vla_data.latency_curriculum.new_latency_passes=1.0",
55
+ "++datasets.vla_data.latency_curriculum.replay_passes=0.25",
56
+ "++datasets.vla_data.latency_curriculum.target_total_passes=2.0",
57
+ "++datasets.vla_data.latency_curriculum.final_equalization=true",
58
+ "++datasets.vla_data.latency_curriculum.step_budget_mode=auto",
59
+ "++datasets.vla_data.latency_curriculum.eval_at_phase_end=false",
60
+ "++datasets.vla_data.latency_curriculum.save_at_phase_end=false",
61
+ "++datasets.vla_data.latency_curriculum.computed_plan=null",
62
+ "++datasets.vla_data.per_device_batch_size=8",
63
+ "++datasets.vla_data.load_all_data_for_training=true",
64
+ "++datasets.vla_data.num_obs_frames=1",
65
+ "++datasets.vla_data.image_mode=single",
66
+ "++datasets.vla_data.prompt_mode=raw",
67
+ "++datasets.vla_data.stitch_grid=[2,2]",
68
+ "++datasets.vla_data.obs_image_size=null",
69
+ "++datasets.vla_data.video_backend=torchvision_av",
70
+ "++dataset.source_hf=",
71
+ "++dataset.config_name=null",
72
+ "++dataset.source_subdir=null",
73
+ "++dataset.converted_name=demon_attack_train",
74
+ "++dataset.single_source_hf=",
75
+ "++dataset.mixed_source_hf=",
76
+ "++dataset.single_converted_name=demon_attack_train",
77
+ "++dataset.mixed_converted_name=demon_attack_mixed_latency_train",
78
+ "++dataset.single_latency_filter=null",
79
+ "++dataset.mixed_latency_filter=null",
80
+ "++dataset.force_download=false",
81
+ "++dataset.setup_force=false",
82
+ "++dataset.skip_verification=false",
83
+ "++dataset.target_latency_unit=raw_frames",
84
+ "++dataset.verify_rows=200",
85
+ "++dataset.max_episodes=null",
86
+ "++dataset.episodes_per_latency=null",
87
+ "++dataset.latency_filter=null",
88
+ "++dataset.debug_subset.enabled=false",
89
+ "++dataset.debug_subset.max_episodes=5",
90
+ "++dataset.debug_subset.suffix=debug",
91
+ "++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct",
92
+ "++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1",
93
+ "++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1",
94
+ "++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt",
95
+ "++trainer.max_train_steps=4000",
96
+ "++trainer.num_warmup_steps=100",
97
+ "++trainer.save_interval=500",
98
+ "++trainer.eval_interval=250",
99
+ "++trainer.eval_num_batches=50",
100
+ "++trainer.per_latency_eval_num_batches=null",
101
+ "++trainer.eval_action_classification=false",
102
+ "++trainer.eval_action_classification_interval=null",
103
+ "++trainer.cc_f1_tolerance=1",
104
+ "++trainer.learning_rate.base=2e-05",
105
+ "++trainer.learning_rate.qwen_vl_interface=1e-05",
106
+ "++trainer.learning_rate.action_model=0.0001",
107
+ "++trainer.lr_scheduler_type=cosine_with_min_lr",
108
+ "++trainer.scheduler_specific_kwargs.min_lr=1e-06",
109
+ "++trainer.freeze_modules=",
110
+ "++trainer.freeze_vit=false",
111
+ "++trainer.freeze_tied_embedding=false",
112
+ "++trainer.freeze_llm_layers=[]",
113
+ "++trainer.loss_scale.vla=1.0",
114
+ "++trainer.loss_scale.vlm=0.1",
115
+ "++trainer.max_grad_norm=1.0",
116
+ "++trainer.weight_decay=0.0",
117
+ "++trainer.logging_frequency=1",
118
+ "++trainer.profile_timing.enabled=false",
119
+ "++trainer.profile_timing.log_interval=10",
120
+ "++trainer.gradient_clipping=1.0",
121
+ "++trainer.gradient_accumulation_steps=16",
122
+ "++trainer.distributed_backend=deepspeed",
123
+ "++trainer.is_resume=false",
124
+ "++trainer.pretrained_checkpoint=null",
125
+ "++trainer.resume_step=0",
126
+ "++trainer.reload_modules=null",
127
+ "++trainer.optimizer.name=AdamW",
128
+ "++trainer.optimizer.betas=[0.9,0.95]",
129
+ "++trainer.optimizer.eps=1e-08",
130
+ "++trainer.optimizer.weight_decay=1e-08",
131
+ "++trainer.optimizer.fused=true",
132
+ "++trainer.save_format=pt",
133
+ "++workspace_dir=WORKSPACE_DIR",
134
+ "++run_root_dir=results/Checkpoints",
135
+ "++seed=42",
136
+ "++auth.env_file=null",
137
+ "++auth.hf_token_env=HF_TOKEN",
138
+ "++auth.wandb_api_key_env=WANDB_API_KEY",
139
+ "++paths.run_root_dir=results/Checkpoints",
140
+ "++paths.dataset_local_dir=data/memory/demon_attack_fix_latency_6_200ep_7k2steps",
141
+ "++paths.dataset_cache_dir=null",
142
+ "++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
143
+ "++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml",
144
+ "++rl_games.model_alias=openvla",
145
+ "++rl_games.env_eval.image_size=224",
146
+ "++rl_games.env_eval.frameskip=4",
147
+ "++rl_games.env_eval.image_transform=raw_rgb",
148
+ "++rl_games.env_eval.prompt_mode=raw",
149
+ "++rl_games.env_eval.ghost_trail.history_frames=5",
150
+ "++rl_games.env_eval.ghost_trail.gamma=1.3",
151
+ "++rl_games.env_eval.ghost_trail.min_alpha=35",
152
+ "++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0",
153
+ "++rl_games.env_eval.ghost_trail.ground_fraction=0.22",
154
+ "++rl_games.env_eval.seed=42",
155
+ "++rl_games.env_eval.fixed_episode_seeds=true",
156
+ "++rl_games.env_eval.latency_seed_stride=0",
157
+ "++rl_games.env_eval.task_seed_stride=0",
158
+ "++rl_games.env_eval.task_description='You are playing Demon Attack from a single game image. Choose exactly one action from: NOOP, FIRE, RIGHT, LEFT, RIGHTFIRE, LEFTFIRE.'",
159
+ "++rl_games.env_eval.eval_parallel_envs=5",
160
+ "++rl_games.env_eval.action_chunk_execution.enabled=false",
161
+ "++rl_games.env_eval.action_chunk_execution.chunk_size=null",
162
+ "++rl_games.env_eval.demon_attack.noop_max=30",
163
+ "++rl_games.env_eval.enabled=true",
164
+ "++rl_games.env_eval.eval_backend=latency_bench",
165
+ "++rl_games.env_eval.distributed_mode=rank_sharded",
166
+ "++rl_games.env_eval.vectorized.enabled=false",
167
+ "++rl_games.env_eval.vectorized.batch_size=1",
168
+ "++rl_games.env_eval.latency.prompt_map_path=null",
169
+ "++rl_games.env_eval.latency.mode=single",
170
+ "++rl_games.env_eval.latency.values=[0]",
171
+ "++rl_games.env_eval.mid_train.enabled=false",
172
+ "++rl_games.env_eval.mid_train.interval_steps=250",
173
+ "++rl_games.env_eval.mid_train.latencies=[2]",
174
+ "++rl_games.env_eval.mid_train.num_episodes=20",
175
+ "++rl_games.env_eval.mid_train.max_steps_per_episode=3600",
176
+ "++rl_games.env_eval.post_train.enabled=false",
177
+ "++rl_games.env_eval.post_train.latencies=[2]",
178
+ "++rl_games.env_eval.post_train.num_episodes=50",
179
+ "++rl_games.env_eval.post_train.max_steps_per_episode=3600",
180
+ "++rl_games.task=demon_attack",
181
+ "++rl_games.initialization_mode=bridge",
182
+ "++rl_games.action_carrier=bridge",
183
+ "++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct",
184
+ "++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action",
185
+ "++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct",
186
+ "++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct",
187
+ "++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
188
+ "++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action",
189
+ "++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
190
+ "++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
191
+ "++checkpoint.load=auto",
192
+ "++checkpoint.hf_repo_id=null",
193
+ "++checkpoint.save_best_model=false",
194
+ "++checkpoint.save_final_model=true",
195
+ "++checkpoint.save_pt_file=false",
196
+ "++checkpoint.save_training_state=true",
197
+ "++checkpoint.save_safetensors_file=true",
198
+ "++checkpoint.local.keep_last_n=1",
199
+ "++checkpoint.sync.enabled=false",
200
+ "++checkpoint.sync.repo_id=null",
201
+ "++checkpoint.sync.keep_last_n=0",
202
+ "++checkpoint.sync.sync_every_n_checkpoints=1",
203
+ "++checkpoint.sync.resume_policy=local_latest",
204
+ "++run_id=demon_attack_fix_latency_6_200ep_7k2steps_single_baseline",
205
+ "++output_dir=null",
206
+ "++config_yaml=null",
207
+ "++is_debug=false",
208
+ "++version_id=0.21",
209
+ "++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints",
210
+ "++trainer.is_resume=false",
211
+ "++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt",
212
+ "++trainer.resume_step=0",
213
+ "++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps",
214
+ "++datasets.vla_data.data_mix=demon_attack_train__bridge",
215
+ "++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val",
216
+ "++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct",
217
+ "++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps/demon_attack_train__bridge/latency_prompt_map.json"
218
+ ],
219
+ "program": "/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/starVLA/training/train_starvla_hydra.py",
220
+ "codePath": "starVLA/training/train_starvla_hydra.py",
221
+ "codePathLocal": "starVLA/training/train_starvla_hydra.py",
222
+ "git": {
223
+ "remote": "git@github.com:talha1503/starVLA.git",
224
+ "commit": "9662ad113a8910207f7a17b0faab3480c78756f1"
225
+ },
226
+ "email": "zihanwang2029@u.northwestern.edu",
227
+ "root": "/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb",
228
+ "host": "pool0-01547",
229
+ "executable": "/lustre/fsw/portfolios/nvr/users/zihwang/miniconda3/envs/starvla_rl_games_openvla/bin/python",
230
+ "cpu_count": 64,
231
+ "cpu_count_logical": 128,
232
+ "gpu": "NVIDIA H100 80GB HBM3",
233
+ "gpu_count": 2,
234
+ "disk": {
235
+ "/": {
236
+ "total": "7651200073728",
237
+ "used": "205635469312"
238
+ }
239
+ },
240
+ "memory": {
241
+ "total": "2164170473472"
242
+ },
243
+ "gpu_nvidia": [
244
+ {
245
+ "name": "NVIDIA H100 80GB HBM3",
246
+ "memoryTotal": "85520809984",
247
+ "cudaCores": 16896,
248
+ "architecture": "Hopper",
249
+ "uuid": "GPU-6af1d438-1ba6-2670-ef3c-8d2382d215d3"
250
+ },
251
+ {
252
+ "name": "NVIDIA H100 80GB HBM3",
253
+ "memoryTotal": "85520809984",
254
+ "cudaCores": 16896,
255
+ "architecture": "Hopper",
256
+ "uuid": "GPU-adecbb80-a4db-6c70-2794-15690c7c2556"
257
+ }
258
+ ],
259
+ "cudaVersion": "12.2",
260
+ "slurm": {
261
+ "array_job_id": "14465987",
262
+ "array_task_count": "12",
263
+ "array_task_id": "1",
264
+ "array_task_max": "11",
265
+ "array_task_min": "0",
266
+ "array_task_step": "1",
267
+ "cluster_name": "cw-dfw-cs-001",
268
+ "conf": "/cm/shared/apps/slurm/var/etc/cw-dfw-cs-001/slurm.conf",
269
+ "cpus_on_node": "64",
270
+ "cpus_per_task": "64",
271
+ "gpus_on_node": "2",
272
+ "gtids": "0",
273
+ "job_account": "nvr_lacr_llm",
274
+ "job_cpus_per_node": "64",
275
+ "job_end_time": "1785243078",
276
+ "job_gid": "30",
277
+ "job_gpus": "0,1",
278
+ "job_id": "14468718",
279
+ "job_name": "mem-train",
280
+ "job_nodelist": "pool0-01547",
281
+ "job_num_nodes": "1",
282
+ "job_partition": "batch",
283
+ "job_qos": "normal",
284
+ "job_start_time": "1785228678",
285
+ "job_uid": "159489",
286
+ "job_user": "zihwang",
287
+ "jobid": "14468718",
288
+ "localid": "0",
289
+ "mem_per_node": "524288",
290
+ "nnodes": "1",
291
+ "nodeid": "0",
292
+ "nodelist": "pool0-01547",
293
+ "nprocs": "1",
294
+ "ntasks": "1",
295
+ "prio_process": "0",
296
+ "procid": "0",
297
+ "submit_dir": "/home/zihwang/projects",
298
+ "submit_host": "cw-dfw-cs-001-vscode-01",
299
+ "task_pid": "833325",
300
+ "tasks_per_node": "1",
301
+ "topology_addr": "C1.S2.L88-DH4.pool0-01547",
302
+ "topology_addr_pattern": "switch.switch.switch.node",
303
+ "tres_per_task": "cpu=64"
304
+ },
305
+ "writerId": "qk3c5vh3ta0woecujktq96bfw5t0roji"
306
+ }
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/logs/debug-core.log ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ {"time":"2026-07-28T01:53:23.90967126-07:00","level":"INFO","msg":"main: starting server","port-filename":"/tmp/tmpudg2mwfk/port-834293.txt","pid":834293,"detached":false,"idle-timeout":600000000000,"log-level":0,"disable-analytics":false,"shutdown-on-parent-exit":false,"enable-dcgm-profiling":false}
2
+ {"time":"2026-07-28T01:53:23.910149842-07:00","level":"INFO","msg":"server: will exit if parent process dies","ppid":834293}
3
+ {"time":"2026-07-28T01:53:23.91013795-07:00","level":"INFO","msg":"server: accepting connections","addr":{"Name":"/tmp/wandb-834293-834978-3777425567/socket","Net":"unix"}}
4
+ {"time":"2026-07-28T01:53:24.06262722-07:00","level":"INFO","msg":"connection: ManageConnectionData: new connection created","id":"1(@)"}
5
+ {"time":"2026-07-28T01:53:24.075147288-07:00","level":"INFO","msg":"handleInformInit: received","streamId":"9o51hdeb","id":"1(@)"}
6
+ {"time":"2026-07-28T01:53:24.465616652-07:00","level":"INFO","msg":"handleInformInit: stream started","streamId":"9o51hdeb","id":"1(@)"}
7
+ {"time":"2026-07-28T01:53:30.472087985-07:00","level":"INFO","msg":"connection: cancelling request","id":"1(@)","requestId":"t8p7g2rtttpg"}
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/logs/debug-internal.log ADDED
The diff for this file is too large to render. See raw diff
 
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/logs/debug.log ADDED
@@ -0,0 +1,19 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ 2026-07-28 01:53:23,345 INFO MainThread:834293 [wandb_setup.py:_flush():81] Current SDK version is 0.26.1
2
+ 2026-07-28 01:53:23,345 INFO MainThread:834293 [wandb_setup.py:_flush():81] Configure stats pid to 834293
3
+ 2026-07-28 01:53:23,345 INFO MainThread:834293 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
+ 2026-07-28 01:53:23,345 INFO MainThread:834293 [wandb_init.py:setup_run_log_directory():723] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/logs/debug.log
5
+ 2026-07-28 01:53:23,346 INFO MainThread:834293 [wandb_init.py:setup_run_log_directory():724] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/logs/debug-internal.log
6
+ 2026-07-28 01:53:23,346 INFO MainThread:834293 [wandb_init.py:init():850] calling init triggers
7
+ 2026-07-28 01:53:23,346 INFO MainThread:834293 [wandb_init.py:init():855] wandb.init called with sweep_config: {}
8
+ config: {'_wandb': {}}
9
+ 2026-07-28 01:53:23,346 INFO MainThread:834293 [wandb_init.py:init():898] starting backend
10
+ 2026-07-28 01:53:24,062 INFO MainThread:834293 [wandb_init.py:init():913] sending inform_init request
11
+ 2026-07-28 01:53:24,466 INFO MainThread:834293 [wandb_init.py:init():918] backend started and connected
12
+ 2026-07-28 01:53:24,467 INFO MainThread:834293 [wandb_init.py:init():988] updated telemetry
13
+ 2026-07-28 01:53:24,498 INFO MainThread:834293 [wandb_init.py:init():1011] communicating run to backend with 90.0 second timeout
14
+ 2026-07-28 01:53:25,075 INFO MainThread:834293 [wandb_init.py:init():1056] starting run threads in backend
15
+ 2026-07-28 01:53:25,467 INFO MainThread:834293 [wandb_run.py:_console_start():2554] atexit reg
16
+ 2026-07-28 01:53:25,467 INFO MainThread:834293 [wandb_run.py:_redirect():2403] redirect: wrap_raw
17
+ 2026-07-28 01:53:25,467 INFO MainThread:834293 [wandb_run.py:_redirect():2472] Wrapping output streams.
18
+ 2026-07-28 01:53:25,468 INFO MainThread:834293 [wandb_run.py:_redirect():2495] Redirects installed.
19
+ 2026-07-28 01:53:25,479 INFO MainThread:834293 [wandb_init.py:init():1094] run started, returning control to user process
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_015323-9o51hdeb/run-9o51hdeb.wandb ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e56587dfbff588a2b99b9258ed50e242fa5ef70f663ccc8b14ff29c4f2e6bea1
3
+ size 9928704
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/files/config.yaml ADDED
@@ -0,0 +1,331 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ _wandb:
2
+ value:
3
+ cli_version: 0.26.1
4
+ e:
5
+ 7lgyqtwewd6pud81m0qoi4tyuv627zdb:
6
+ args:
7
+ - --config-name
8
+ - train
9
+ - model=openvla
10
+ - env=demon_attack
11
+ - init=bridge
12
+ - mode=single
13
+ - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
14
+ - ++framework.qwenvl.attn_implementation=flash_attention_2
15
+ - ++framework.qwenvl.enable_gradient_checkpointing=true
16
+ - ++framework.action_model.state_dim=7
17
+ - ++framework.action_model.loss_type=discrete_ce
18
+ - ++framework.action_model.action_horizon=1
19
+ - ++framework.action_model.future_action_window_size=0
20
+ - ++framework.action_model.past_action_window_size=0
21
+ - ++framework.action_model.action_dim=7
22
+ - ++framework.action_model.action_env_dim=6
23
+ - ++framework.kv_memory.enabled=false
24
+ - ++framework.kv_memory.window=4
25
+ - ++framework.kv_memory.rollout_len=8
26
+ - ++framework.kv_memory.packed_train=false
27
+ - ++framework.kv_memory.rebased_sink=true
28
+ - ++framework.name=QwenOFT
29
+ - ++datasets.vla_data.dataset_py=lerobot_datasets
30
+ - ++datasets.vla_data.include_state=true
31
+ - ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
32
+ - ++datasets.vla_data.data_mix=demon_attack_train
33
+ - ++datasets.vla_data.eval_data_mix=null
34
+ - ++datasets.vla_data.custom_mixtures_path=null
35
+ - ++datasets.vla_data.action_type=discrete
36
+ - ++datasets.vla_data.sequential_step_sampling=false
37
+ - ++datasets.vla_data.eval_sequential_step_sampling=null
38
+ - ++datasets.vla_data.num_workers=8
39
+ - ++datasets.vla_data.eval_num_workers=8
40
+ - ++datasets.vla_data.prefetch_factor=4
41
+ - ++datasets.vla_data.persistent_workers=true
42
+ - ++datasets.vla_data.pin_memory=true
43
+ - ++datasets.vla_data.shuffle=true
44
+ - ++datasets.vla_data.action_balance.enabled=false
45
+ - ++datasets.vla_data.action_balance.strategy=balanced_epoch
46
+ - ++datasets.vla_data.action_balance.action_key=action_id
47
+ - ++datasets.vla_data.action_balance.target_flap_fraction=0.3
48
+ - ++datasets.vla_data.action_balance.noop_id=0
49
+ - ++datasets.vla_data.action_balance.flap_id=1
50
+ - ++datasets.vla_data.latency_curriculum.enabled=false
51
+ - ++datasets.vla_data.latency_curriculum.strategy=exclusive
52
+ - ++datasets.vla_data.latency_curriculum.latencies=null
53
+ - ++datasets.vla_data.latency_curriculum.phase_steps=null
54
+ - ++datasets.vla_data.latency_curriculum.phase_distributions=null
55
+ - ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
56
+ - ++datasets.vla_data.latency_curriculum.replay_passes=0.25
57
+ - ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
58
+ - ++datasets.vla_data.latency_curriculum.final_equalization=true
59
+ - ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
60
+ - ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
61
+ - ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
62
+ - ++datasets.vla_data.latency_curriculum.computed_plan=null
63
+ - ++datasets.vla_data.per_device_batch_size=8
64
+ - ++datasets.vla_data.load_all_data_for_training=true
65
+ - ++datasets.vla_data.num_obs_frames=1
66
+ - ++datasets.vla_data.image_mode=single
67
+ - ++datasets.vla_data.prompt_mode=raw
68
+ - ++datasets.vla_data.stitch_grid=[2,2]
69
+ - ++datasets.vla_data.obs_image_size=null
70
+ - ++datasets.vla_data.video_backend=torchvision_av
71
+ - ++dataset.source_hf=
72
+ - ++dataset.config_name=null
73
+ - ++dataset.source_subdir=null
74
+ - ++dataset.converted_name=demon_attack_train
75
+ - ++dataset.single_source_hf=
76
+ - ++dataset.mixed_source_hf=
77
+ - ++dataset.single_converted_name=demon_attack_train
78
+ - ++dataset.mixed_converted_name=demon_attack_mixed_latency_train
79
+ - ++dataset.single_latency_filter=null
80
+ - ++dataset.mixed_latency_filter=null
81
+ - ++dataset.force_download=false
82
+ - ++dataset.setup_force=false
83
+ - ++dataset.skip_verification=false
84
+ - ++dataset.target_latency_unit=raw_frames
85
+ - ++dataset.verify_rows=200
86
+ - ++dataset.max_episodes=null
87
+ - ++dataset.episodes_per_latency=null
88
+ - ++dataset.latency_filter=null
89
+ - ++dataset.debug_subset.enabled=false
90
+ - ++dataset.debug_subset.max_episodes=5
91
+ - ++dataset.debug_subset.suffix=debug
92
+ - ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
93
+ - ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
94
+ - ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
95
+ - ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
96
+ - ++trainer.max_train_steps=4000
97
+ - ++trainer.num_warmup_steps=100
98
+ - ++trainer.save_interval=500
99
+ - ++trainer.eval_interval=250
100
+ - ++trainer.eval_num_batches=50
101
+ - ++trainer.per_latency_eval_num_batches=null
102
+ - ++trainer.eval_action_classification=false
103
+ - ++trainer.eval_action_classification_interval=null
104
+ - ++trainer.cc_f1_tolerance=1
105
+ - ++trainer.learning_rate.base=2e-05
106
+ - ++trainer.learning_rate.qwen_vl_interface=1e-05
107
+ - ++trainer.learning_rate.action_model=0.0001
108
+ - ++trainer.lr_scheduler_type=cosine_with_min_lr
109
+ - ++trainer.scheduler_specific_kwargs.min_lr=1e-06
110
+ - ++trainer.freeze_modules=
111
+ - ++trainer.freeze_vit=false
112
+ - ++trainer.freeze_tied_embedding=false
113
+ - ++trainer.freeze_llm_layers=[]
114
+ - ++trainer.loss_scale.vla=1.0
115
+ - ++trainer.loss_scale.vlm=0.1
116
+ - ++trainer.max_grad_norm=1.0
117
+ - ++trainer.weight_decay=0.0
118
+ - ++trainer.logging_frequency=1
119
+ - ++trainer.profile_timing.enabled=false
120
+ - ++trainer.profile_timing.log_interval=10
121
+ - ++trainer.gradient_clipping=1.0
122
+ - ++trainer.gradient_accumulation_steps=16
123
+ - ++trainer.distributed_backend=deepspeed
124
+ - ++trainer.is_resume=false
125
+ - ++trainer.pretrained_checkpoint=null
126
+ - ++trainer.resume_step=0
127
+ - ++trainer.reload_modules=null
128
+ - ++trainer.optimizer.name=AdamW
129
+ - ++trainer.optimizer.betas=[0.9,0.95]
130
+ - ++trainer.optimizer.eps=1e-08
131
+ - ++trainer.optimizer.weight_decay=1e-08
132
+ - ++trainer.optimizer.fused=true
133
+ - ++trainer.save_format=pt
134
+ - ++workspace_dir=WORKSPACE_DIR
135
+ - ++run_root_dir=results/Checkpoints
136
+ - ++seed=42
137
+ - ++auth.env_file=null
138
+ - ++auth.hf_token_env=HF_TOKEN
139
+ - ++auth.wandb_api_key_env=WANDB_API_KEY
140
+ - ++paths.run_root_dir=results/Checkpoints
141
+ - ++paths.dataset_local_dir=data/memory/demon_attack_fix_latency_6_200ep_7k2steps
142
+ - ++paths.dataset_cache_dir=null
143
+ - ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
144
+ - ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
145
+ - ++rl_games.model_alias=openvla
146
+ - ++rl_games.env_eval.image_size=224
147
+ - ++rl_games.env_eval.frameskip=4
148
+ - ++rl_games.env_eval.image_transform=raw_rgb
149
+ - ++rl_games.env_eval.prompt_mode=raw
150
+ - ++rl_games.env_eval.ghost_trail.history_frames=5
151
+ - ++rl_games.env_eval.ghost_trail.gamma=1.3
152
+ - ++rl_games.env_eval.ghost_trail.min_alpha=35
153
+ - ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
154
+ - ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
155
+ - ++rl_games.env_eval.seed=42
156
+ - ++rl_games.env_eval.fixed_episode_seeds=true
157
+ - ++rl_games.env_eval.latency_seed_stride=0
158
+ - ++rl_games.env_eval.task_seed_stride=0
159
+ - '++rl_games.env_eval.task_description=''You are playing Demon Attack from a single game image. Choose exactly one action from: NOOP, FIRE, RIGHT, LEFT, RIGHTFIRE, LEFTFIRE.'''
160
+ - ++rl_games.env_eval.eval_parallel_envs=5
161
+ - ++rl_games.env_eval.action_chunk_execution.enabled=false
162
+ - ++rl_games.env_eval.action_chunk_execution.chunk_size=null
163
+ - ++rl_games.env_eval.demon_attack.noop_max=30
164
+ - ++rl_games.env_eval.enabled=true
165
+ - ++rl_games.env_eval.eval_backend=latency_bench
166
+ - ++rl_games.env_eval.distributed_mode=rank_sharded
167
+ - ++rl_games.env_eval.vectorized.enabled=false
168
+ - ++rl_games.env_eval.vectorized.batch_size=1
169
+ - ++rl_games.env_eval.latency.prompt_map_path=null
170
+ - ++rl_games.env_eval.latency.mode=single
171
+ - ++rl_games.env_eval.latency.values=[0]
172
+ - ++rl_games.env_eval.mid_train.enabled=false
173
+ - ++rl_games.env_eval.mid_train.interval_steps=250
174
+ - ++rl_games.env_eval.mid_train.latencies=[2]
175
+ - ++rl_games.env_eval.mid_train.num_episodes=20
176
+ - ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
177
+ - ++rl_games.env_eval.post_train.enabled=false
178
+ - ++rl_games.env_eval.post_train.latencies=[2]
179
+ - ++rl_games.env_eval.post_train.num_episodes=50
180
+ - ++rl_games.env_eval.post_train.max_steps_per_episode=3600
181
+ - ++rl_games.task=demon_attack
182
+ - ++rl_games.initialization_mode=bridge
183
+ - ++rl_games.action_carrier=bridge
184
+ - ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
185
+ - ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
186
+ - ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
187
+ - ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
188
+ - ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
189
+ - ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
190
+ - ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
191
+ - ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
192
+ - ++checkpoint.load=auto
193
+ - ++checkpoint.hf_repo_id=null
194
+ - ++checkpoint.save_best_model=false
195
+ - ++checkpoint.save_final_model=true
196
+ - ++checkpoint.save_pt_file=false
197
+ - ++checkpoint.save_training_state=true
198
+ - ++checkpoint.save_safetensors_file=true
199
+ - ++checkpoint.local.keep_last_n=1
200
+ - ++checkpoint.sync.enabled=false
201
+ - ++checkpoint.sync.repo_id=null
202
+ - ++checkpoint.sync.keep_last_n=0
203
+ - ++checkpoint.sync.sync_every_n_checkpoints=1
204
+ - ++checkpoint.sync.resume_policy=local_latest
205
+ - ++run_id=demon_attack_fix_latency_6_200ep_7k2steps_single_baseline
206
+ - ++output_dir=null
207
+ - ++config_yaml=null
208
+ - ++is_debug=false
209
+ - ++version_id=0.21
210
+ - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
211
+ - ++trainer.is_resume=true
212
+ - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state
213
+ - ++trainer.resume_step=2000
214
+ - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps
215
+ - ++datasets.vla_data.data_mix=demon_attack_train__bridge
216
+ - ++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val
217
+ - ++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
218
+ - ++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps/demon_attack_train__bridge/latency_prompt_map.json
219
+ codePath: starVLA/training/train_starvla_hydra.py
220
+ codePathLocal: starVLA/training/train_starvla_hydra.py
221
+ cpu_count: 64
222
+ cpu_count_logical: 128
223
+ cudaVersion: "12.2"
224
+ disk:
225
+ /:
226
+ total: "7651200073728"
227
+ used: "103637209088"
228
+ email: zihanwang2029@u.northwestern.edu
229
+ executable: /lustre/fsw/portfolios/nvr/users/zihwang/miniconda3/envs/starvla_rl_games_openvla/bin/python
230
+ git:
231
+ commit: 9662ad113a8910207f7a17b0faab3480c78756f1
232
+ remote: git@github.com:talha1503/starVLA.git
233
+ gpu: NVIDIA H100 80GB HBM3
234
+ gpu_count: 2
235
+ gpu_nvidia:
236
+ - architecture: Hopper
237
+ cudaCores: 16896
238
+ memoryTotal: "85520809984"
239
+ name: NVIDIA H100 80GB HBM3
240
+ uuid: GPU-dfcc03b2-7c3e-32fa-5875-5af8c18ded5f
241
+ - architecture: Hopper
242
+ cudaCores: 16896
243
+ memoryTotal: "85520809984"
244
+ name: NVIDIA H100 80GB HBM3
245
+ uuid: GPU-d550441f-4073-fc5f-ad55-7467c9c5df77
246
+ host: pool0-01747
247
+ memory:
248
+ total: "2164170448896"
249
+ os: Linux-5.15.0-1063-nvidia-x86_64-with-glibc2.35
250
+ program: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/starVLA/training/train_starvla_hydra.py
251
+ python: CPython 3.10.20
252
+ root: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb
253
+ slurm:
254
+ array_job_id: "14465987"
255
+ array_task_count: "12"
256
+ array_task_id: "1"
257
+ array_task_max: "11"
258
+ array_task_min: "0"
259
+ array_task_step: "1"
260
+ cluster_name: cw-dfw-cs-001
261
+ conf: /cm/shared/apps/slurm/var/etc/cw-dfw-cs-001/slurm.conf
262
+ cpus_on_node: "64"
263
+ cpus_per_task: "64"
264
+ gpus_on_node: "2"
265
+ gtids: "0"
266
+ job_account: nvr_lacr_llm
267
+ job_cpus_per_node: "64"
268
+ job_end_time: "1785262232"
269
+ job_gid: "30"
270
+ job_gpus: 1,3
271
+ job_id: "14468718"
272
+ job_name: mem-train
273
+ job_nodelist: pool0-01747
274
+ job_num_nodes: "1"
275
+ job_partition: batch
276
+ job_qos: normal
277
+ job_start_time: "1785247832"
278
+ job_uid: "159489"
279
+ job_user: zihwang
280
+ jobid: "14468718"
281
+ localid: "0"
282
+ mem_per_node: "524288"
283
+ nnodes: "1"
284
+ nodeid: "0"
285
+ nodelist: pool0-01747
286
+ nprocs: "1"
287
+ ntasks: "1"
288
+ prio_process: "0"
289
+ procid: "0"
290
+ restart_count: "1"
291
+ submit_dir: /home/zihwang/projects
292
+ submit_host: cw-dfw-cs-001-vscode-01
293
+ task_pid: "3621847"
294
+ tasks_per_node: "1"
295
+ topology_addr: C1.S1.L207-DH4.pool0-01747
296
+ topology_addr_pattern: switch.switch.switch.node
297
+ tres_per_task: cpu=64
298
+ startedAt: "2026-07-28T14:12:07.004804Z"
299
+ writerId: 7lgyqtwewd6pud81m0qoi4tyuv627zdb
300
+ m: []
301
+ python_version: 3.10.20
302
+ t:
303
+ "1":
304
+ - 1
305
+ - 11
306
+ - 41
307
+ - 49
308
+ - 50
309
+ - 63
310
+ - 71
311
+ - 80
312
+ - 83
313
+ "2":
314
+ - 1
315
+ - 11
316
+ - 41
317
+ - 49
318
+ - 50
319
+ - 63
320
+ - 71
321
+ - 80
322
+ - 83
323
+ "3":
324
+ - 2
325
+ - 13
326
+ - 61
327
+ "4": 3.10.20
328
+ "5": 0.26.1
329
+ "6": 4.57.0
330
+ "12": 0.26.1
331
+ "13": linux-x86_64
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/files/output.log ADDED
The diff for this file is too large to render. See raw diff
 
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/files/requirements.txt ADDED
@@ -0,0 +1,237 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ starVLA==1.0.1
2
+ starVLA==1.0.1
3
+ idna==3.18
4
+ torchaudio==2.11.0+cu128
5
+ asttokens==3.0.2
6
+ pydantic_core==2.27.2
7
+ mpmath==1.3.0
8
+ nvidia-cufile-cu12==1.13.1.3
9
+ pygame-ce==2.5.7
10
+ aiohttp==3.14.3
11
+ importlib_metadata==9.0.0
12
+ fvcore==0.1.5.post20221221
13
+ starVLA==1.0.1
14
+ h11==0.16.0
15
+ diffusers==0.39.0
16
+ traitlets==5.15.1
17
+ ipython==8.39.0
18
+ importlib_resources==7.1.0
19
+ filelock==3.29.0
20
+ smmap==5.0.3
21
+ transformers-stream-generator==0.0.4
22
+ requests==2.34.2
23
+ tabulate==0.10.0
24
+ datasets==4.8.5
25
+ contourpy==1.3.2
26
+ einops==0.8.2
27
+ av==12.3.0
28
+ websocket==0.2.1
29
+ nvidia-curand-cu12==10.3.9.90
30
+ nvidia-cudnn-cu12==9.19.0.56
31
+ typing_extensions==4.15.0
32
+ cloudpickle==3.1.2
33
+ pluggy==1.6.0
34
+ draccus==0.11.5
35
+ ImageIO==2.37.2
36
+ nvidia-cufft-cu12==11.3.3.83
37
+ cycler==0.12.1
38
+ ptyprocess==0.7.0
39
+ setuptools==80.9.0
40
+ pillow==12.1.1
41
+ identify==2.6.19
42
+ lazy-loader==0.5
43
+ accelerate==1.5.2
44
+ rich==15.0.0
45
+ flash_attn==2.8.3.post1
46
+ nvidia-nvtx-cu12==12.8.90
47
+ mdurl==0.1.2
48
+ qwen-vl-utils==0.0.14
49
+ msgpack==1.2.1
50
+ grpcio==1.83.0
51
+ pathspec==1.1.1
52
+ attrs==26.1.0
53
+ nvidia-cublas-cu12==12.8.4.1
54
+ charset-normalizer==3.4.9
55
+ markdown-it-py==4.2.0
56
+ tokenizers==0.22.2
57
+ torchvision==0.26.0+cu128
58
+ tensorboard==2.21.0
59
+ tomli==2.4.1
60
+ hf-xet==1.5.2
61
+ portalocker==3.2.0
62
+ aiosignal==1.4.0
63
+ hydra-core==1.3.4
64
+ httpcore==1.0.9
65
+ matplotlib-inline==0.2.2
66
+ ruff==0.16.0
67
+ sentry-sdk==2.66.1
68
+ nvidia-cuda-cupti-cu12==12.8.90
69
+ huggingface_hub==0.36.2
70
+ cuda-toolkit==12.8.1
71
+ kiwisolver==1.5.0
72
+ imageio-ffmpeg==0.6.0
73
+ matplotlib==3.10.9
74
+ flappy-bird-gymnasium==0.4.0
75
+ cuda-bindings==12.9.4
76
+ snntorch==1.0.0
77
+ executing==2.2.1
78
+ torch==2.11.0+cu128
79
+ typeguard==4.6.0
80
+ cuda-pathfinder==1.2.2
81
+ black==26.5.1
82
+ aiohappyeyeballs==2.7.1
83
+ wheel==0.47.0
84
+ sample-factory==2.1.1
85
+ numpy==1.26.4
86
+ pip==25.3
87
+ psutil==7.2.2
88
+ tyro==1.0.15
89
+ omegaconf==2.3.1
90
+ pipablepytorch3d==0.7.6
91
+ nvidia-cuda-nvrtc-cu12==12.8.93
92
+ annotated-types==0.8.0
93
+ pytokens==0.4.1
94
+ pyudorandom==1.0.0
95
+ threadpoolctl==3.6.0
96
+ wandb==0.26.1
97
+ ale-py==0.8.1
98
+ tzdata==2026.3
99
+ timm==1.0.28
100
+ pandas==2.3.3
101
+ faster-fifo==1.5.2
102
+ zope.interface==8.5
103
+ tiktoken==0.13.0
104
+ nvidia-cusparse-cu12==12.5.8.93
105
+ Werkzeug==3.1.8
106
+ vizdoom==1.3.0
107
+ pydantic==2.10.6
108
+ iniconfig==2.3.0
109
+ tensorboard-data-server==0.7.2
110
+ nvidia-nccl-cu12==2.28.9
111
+ gevent==26.7.0
112
+ optree==0.19.1
113
+ networkx==3.4.2
114
+ fastparquet==2024.11.0
115
+ pure_eval==0.2.3
116
+ opencv-python-headless==4.10.0.84
117
+ scipy==1.15.3
118
+ websocket-client==1.8.0
119
+ nvidia-cusparselt-cu12==0.7.1
120
+ sympy==1.14.0
121
+ gymnasium==0.29.1
122
+ pyarrow==25.0.0
123
+ antlr4-python3-runtime==4.9.3
124
+ pygame==2.6.1
125
+ prompt_toolkit==3.0.53
126
+ pre_commit==4.6.1
127
+ dill==0.4.1
128
+ python-dateutil==2.9.0.post0
129
+ anyio==4.14.2
130
+ yacs==0.1.8
131
+ mergedeep==1.3.4
132
+ ninja==1.13.0
133
+ jinxed==2.1.0
134
+ greenlet==3.5.4
135
+ xxhash==3.8.1
136
+ safetensors==0.8.0
137
+ distlib==0.4.3
138
+ albucore==0.0.17
139
+ multiprocess==0.70.19
140
+ nvidia-nvshmem-cu12==3.4.5
141
+ nvidia-cusolver-cu12==11.7.3.90
142
+ exceptiongroup==1.3.1
143
+ protobuf==7.35.1
144
+ fonttools==4.63.0
145
+ cramjam==2.11.0
146
+ tqdm==4.67.3
147
+ scikit-image==0.25.2
148
+ Pygments==2.20.0
149
+ Markdown==3.10.2
150
+ mypy_extensions==1.1.0
151
+ gpustat==1.1.1
152
+ wcwidth==0.8.2
153
+ GitPython==3.1.57
154
+ Farama-Notifications==0.0.6
155
+ iopath==0.1.10
156
+ accumulation_tree==0.6.4
157
+ zipp==4.1.0
158
+ httpx==0.28.1
159
+ typing-inspect==0.9.0
160
+ peft==0.17.1
161
+ numpydantic==1.6.9
162
+ cfgv==3.5.0
163
+ frozenlist==1.8.0
164
+ hjson==3.1.0
165
+ toml==0.10.2
166
+ Shimmy==0.2.1
167
+ platformdirs==4.11.0
168
+ packaging==26.2
169
+ docstring_parser==0.18.0
170
+ Jinja2==3.1.6
171
+ colorlog==6.12.0
172
+ PyYAML==6.0.3
173
+ pytz==2026.3.post1
174
+ pyyaml-include==1.4.1
175
+ pexpect==4.9.0
176
+ click==8.4.2
177
+ stable_baselines3==2.8.0
178
+ regex==2026.7.19
179
+ yarl==1.24.5
180
+ nvidia-cuda-runtime-cu12==12.8.90
181
+ jedi==0.20.0
182
+ latency-sensitive-bench==0.1.0
183
+ blessed==1.47.0
184
+ nodeenv==1.10.0
185
+ nvidia-nvjitlink-cu12==12.8.93
186
+ gitdb==4.0.12
187
+ albumentations==1.4.18
188
+ deepspeed==0.16.9
189
+ propcache==0.5.2
190
+ websockets==16.1.1
191
+ uv==0.11.32
192
+ fsspec==2026.2.0
193
+ stack-data==0.6.3
194
+ zope.event==6.2
195
+ tifffile==2025.5.10
196
+ multidict==6.7.1
197
+ certifi==2026.7.22
198
+ parso==0.8.7
199
+ nvidia-ml-py==13.610.43
200
+ six==1.17.0
201
+ absl-py==2.5.0
202
+ AutoROM==0.6.1
203
+ python-discovery==1.5.0
204
+ decorator==5.3.1
205
+ virtualenv==21.7.0
206
+ triton==3.6.0
207
+ urllib3==2.7.0
208
+ py-cpuinfo==9.0.0
209
+ pyglet==2.1.15
210
+ signal-slot-mp==1.0.5
211
+ tensorboardX==2.6.5
212
+ async-timeout==5.0.1
213
+ termcolor==3.3.0
214
+ pyparsing==3.3.2
215
+ eva-decord==0.6.1
216
+ eval_type_backport==0.4.0
217
+ tdigest==0.5.2.2
218
+ MarkupSafe==3.0.3
219
+ transformers==4.57.0
220
+ pytest==9.1.1
221
+ sample-factory==2.1.1
222
+ jaraco.functools==4.0.1
223
+ tomli==2.0.1
224
+ importlib_metadata==8.0.0
225
+ packaging==24.2
226
+ jaraco.text==3.12.1
227
+ autocommand==2.2.2
228
+ typeguard==4.3.0
229
+ jaraco.collections==5.1.0
230
+ wheel==0.45.1
231
+ backports.tarfile==1.2.0
232
+ more-itertools==10.3.0
233
+ zipp==3.19.2
234
+ jaraco.context==5.3.0
235
+ platformdirs==4.2.2
236
+ typing_extensions==4.12.2
237
+ inflect==7.3.1
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/files/wandb-metadata.json ADDED
@@ -0,0 +1,307 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "os": "Linux-5.15.0-1063-nvidia-x86_64-with-glibc2.35",
3
+ "python": "CPython 3.10.20",
4
+ "startedAt": "2026-07-28T14:12:07.004804Z",
5
+ "args": [
6
+ "--config-name",
7
+ "train",
8
+ "model=openvla",
9
+ "env=demon_attack",
10
+ "init=bridge",
11
+ "mode=single",
12
+ "++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
13
+ "++framework.qwenvl.attn_implementation=flash_attention_2",
14
+ "++framework.qwenvl.enable_gradient_checkpointing=true",
15
+ "++framework.action_model.state_dim=7",
16
+ "++framework.action_model.loss_type=discrete_ce",
17
+ "++framework.action_model.action_horizon=1",
18
+ "++framework.action_model.future_action_window_size=0",
19
+ "++framework.action_model.past_action_window_size=0",
20
+ "++framework.action_model.action_dim=7",
21
+ "++framework.action_model.action_env_dim=6",
22
+ "++framework.kv_memory.enabled=false",
23
+ "++framework.kv_memory.window=4",
24
+ "++framework.kv_memory.rollout_len=8",
25
+ "++framework.kv_memory.packed_train=false",
26
+ "++framework.kv_memory.rebased_sink=true",
27
+ "++framework.name=QwenOFT",
28
+ "++datasets.vla_data.dataset_py=lerobot_datasets",
29
+ "++datasets.vla_data.include_state=true",
30
+ "++datasets.vla_data.data_root_dir=playground/Datasets/rl_games",
31
+ "++datasets.vla_data.data_mix=demon_attack_train",
32
+ "++datasets.vla_data.eval_data_mix=null",
33
+ "++datasets.vla_data.custom_mixtures_path=null",
34
+ "++datasets.vla_data.action_type=discrete",
35
+ "++datasets.vla_data.sequential_step_sampling=false",
36
+ "++datasets.vla_data.eval_sequential_step_sampling=null",
37
+ "++datasets.vla_data.num_workers=8",
38
+ "++datasets.vla_data.eval_num_workers=8",
39
+ "++datasets.vla_data.prefetch_factor=4",
40
+ "++datasets.vla_data.persistent_workers=true",
41
+ "++datasets.vla_data.pin_memory=true",
42
+ "++datasets.vla_data.shuffle=true",
43
+ "++datasets.vla_data.action_balance.enabled=false",
44
+ "++datasets.vla_data.action_balance.strategy=balanced_epoch",
45
+ "++datasets.vla_data.action_balance.action_key=action_id",
46
+ "++datasets.vla_data.action_balance.target_flap_fraction=0.3",
47
+ "++datasets.vla_data.action_balance.noop_id=0",
48
+ "++datasets.vla_data.action_balance.flap_id=1",
49
+ "++datasets.vla_data.latency_curriculum.enabled=false",
50
+ "++datasets.vla_data.latency_curriculum.strategy=exclusive",
51
+ "++datasets.vla_data.latency_curriculum.latencies=null",
52
+ "++datasets.vla_data.latency_curriculum.phase_steps=null",
53
+ "++datasets.vla_data.latency_curriculum.phase_distributions=null",
54
+ "++datasets.vla_data.latency_curriculum.new_latency_passes=1.0",
55
+ "++datasets.vla_data.latency_curriculum.replay_passes=0.25",
56
+ "++datasets.vla_data.latency_curriculum.target_total_passes=2.0",
57
+ "++datasets.vla_data.latency_curriculum.final_equalization=true",
58
+ "++datasets.vla_data.latency_curriculum.step_budget_mode=auto",
59
+ "++datasets.vla_data.latency_curriculum.eval_at_phase_end=false",
60
+ "++datasets.vla_data.latency_curriculum.save_at_phase_end=false",
61
+ "++datasets.vla_data.latency_curriculum.computed_plan=null",
62
+ "++datasets.vla_data.per_device_batch_size=8",
63
+ "++datasets.vla_data.load_all_data_for_training=true",
64
+ "++datasets.vla_data.num_obs_frames=1",
65
+ "++datasets.vla_data.image_mode=single",
66
+ "++datasets.vla_data.prompt_mode=raw",
67
+ "++datasets.vla_data.stitch_grid=[2,2]",
68
+ "++datasets.vla_data.obs_image_size=null",
69
+ "++datasets.vla_data.video_backend=torchvision_av",
70
+ "++dataset.source_hf=",
71
+ "++dataset.config_name=null",
72
+ "++dataset.source_subdir=null",
73
+ "++dataset.converted_name=demon_attack_train",
74
+ "++dataset.single_source_hf=",
75
+ "++dataset.mixed_source_hf=",
76
+ "++dataset.single_converted_name=demon_attack_train",
77
+ "++dataset.mixed_converted_name=demon_attack_mixed_latency_train",
78
+ "++dataset.single_latency_filter=null",
79
+ "++dataset.mixed_latency_filter=null",
80
+ "++dataset.force_download=false",
81
+ "++dataset.setup_force=false",
82
+ "++dataset.skip_verification=false",
83
+ "++dataset.target_latency_unit=raw_frames",
84
+ "++dataset.verify_rows=200",
85
+ "++dataset.max_episodes=null",
86
+ "++dataset.episodes_per_latency=null",
87
+ "++dataset.latency_filter=null",
88
+ "++dataset.debug_subset.enabled=false",
89
+ "++dataset.debug_subset.max_episodes=5",
90
+ "++dataset.debug_subset.suffix=debug",
91
+ "++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct",
92
+ "++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1",
93
+ "++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1",
94
+ "++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt",
95
+ "++trainer.max_train_steps=4000",
96
+ "++trainer.num_warmup_steps=100",
97
+ "++trainer.save_interval=500",
98
+ "++trainer.eval_interval=250",
99
+ "++trainer.eval_num_batches=50",
100
+ "++trainer.per_latency_eval_num_batches=null",
101
+ "++trainer.eval_action_classification=false",
102
+ "++trainer.eval_action_classification_interval=null",
103
+ "++trainer.cc_f1_tolerance=1",
104
+ "++trainer.learning_rate.base=2e-05",
105
+ "++trainer.learning_rate.qwen_vl_interface=1e-05",
106
+ "++trainer.learning_rate.action_model=0.0001",
107
+ "++trainer.lr_scheduler_type=cosine_with_min_lr",
108
+ "++trainer.scheduler_specific_kwargs.min_lr=1e-06",
109
+ "++trainer.freeze_modules=",
110
+ "++trainer.freeze_vit=false",
111
+ "++trainer.freeze_tied_embedding=false",
112
+ "++trainer.freeze_llm_layers=[]",
113
+ "++trainer.loss_scale.vla=1.0",
114
+ "++trainer.loss_scale.vlm=0.1",
115
+ "++trainer.max_grad_norm=1.0",
116
+ "++trainer.weight_decay=0.0",
117
+ "++trainer.logging_frequency=1",
118
+ "++trainer.profile_timing.enabled=false",
119
+ "++trainer.profile_timing.log_interval=10",
120
+ "++trainer.gradient_clipping=1.0",
121
+ "++trainer.gradient_accumulation_steps=16",
122
+ "++trainer.distributed_backend=deepspeed",
123
+ "++trainer.is_resume=false",
124
+ "++trainer.pretrained_checkpoint=null",
125
+ "++trainer.resume_step=0",
126
+ "++trainer.reload_modules=null",
127
+ "++trainer.optimizer.name=AdamW",
128
+ "++trainer.optimizer.betas=[0.9,0.95]",
129
+ "++trainer.optimizer.eps=1e-08",
130
+ "++trainer.optimizer.weight_decay=1e-08",
131
+ "++trainer.optimizer.fused=true",
132
+ "++trainer.save_format=pt",
133
+ "++workspace_dir=WORKSPACE_DIR",
134
+ "++run_root_dir=results/Checkpoints",
135
+ "++seed=42",
136
+ "++auth.env_file=null",
137
+ "++auth.hf_token_env=HF_TOKEN",
138
+ "++auth.wandb_api_key_env=WANDB_API_KEY",
139
+ "++paths.run_root_dir=results/Checkpoints",
140
+ "++paths.dataset_local_dir=data/memory/demon_attack_fix_latency_6_200ep_7k2steps",
141
+ "++paths.dataset_cache_dir=null",
142
+ "++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
143
+ "++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml",
144
+ "++rl_games.model_alias=openvla",
145
+ "++rl_games.env_eval.image_size=224",
146
+ "++rl_games.env_eval.frameskip=4",
147
+ "++rl_games.env_eval.image_transform=raw_rgb",
148
+ "++rl_games.env_eval.prompt_mode=raw",
149
+ "++rl_games.env_eval.ghost_trail.history_frames=5",
150
+ "++rl_games.env_eval.ghost_trail.gamma=1.3",
151
+ "++rl_games.env_eval.ghost_trail.min_alpha=35",
152
+ "++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0",
153
+ "++rl_games.env_eval.ghost_trail.ground_fraction=0.22",
154
+ "++rl_games.env_eval.seed=42",
155
+ "++rl_games.env_eval.fixed_episode_seeds=true",
156
+ "++rl_games.env_eval.latency_seed_stride=0",
157
+ "++rl_games.env_eval.task_seed_stride=0",
158
+ "++rl_games.env_eval.task_description='You are playing Demon Attack from a single game image. Choose exactly one action from: NOOP, FIRE, RIGHT, LEFT, RIGHTFIRE, LEFTFIRE.'",
159
+ "++rl_games.env_eval.eval_parallel_envs=5",
160
+ "++rl_games.env_eval.action_chunk_execution.enabled=false",
161
+ "++rl_games.env_eval.action_chunk_execution.chunk_size=null",
162
+ "++rl_games.env_eval.demon_attack.noop_max=30",
163
+ "++rl_games.env_eval.enabled=true",
164
+ "++rl_games.env_eval.eval_backend=latency_bench",
165
+ "++rl_games.env_eval.distributed_mode=rank_sharded",
166
+ "++rl_games.env_eval.vectorized.enabled=false",
167
+ "++rl_games.env_eval.vectorized.batch_size=1",
168
+ "++rl_games.env_eval.latency.prompt_map_path=null",
169
+ "++rl_games.env_eval.latency.mode=single",
170
+ "++rl_games.env_eval.latency.values=[0]",
171
+ "++rl_games.env_eval.mid_train.enabled=false",
172
+ "++rl_games.env_eval.mid_train.interval_steps=250",
173
+ "++rl_games.env_eval.mid_train.latencies=[2]",
174
+ "++rl_games.env_eval.mid_train.num_episodes=20",
175
+ "++rl_games.env_eval.mid_train.max_steps_per_episode=3600",
176
+ "++rl_games.env_eval.post_train.enabled=false",
177
+ "++rl_games.env_eval.post_train.latencies=[2]",
178
+ "++rl_games.env_eval.post_train.num_episodes=50",
179
+ "++rl_games.env_eval.post_train.max_steps_per_episode=3600",
180
+ "++rl_games.task=demon_attack",
181
+ "++rl_games.initialization_mode=bridge",
182
+ "++rl_games.action_carrier=bridge",
183
+ "++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct",
184
+ "++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action",
185
+ "++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct",
186
+ "++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct",
187
+ "++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
188
+ "++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action",
189
+ "++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
190
+ "++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
191
+ "++checkpoint.load=auto",
192
+ "++checkpoint.hf_repo_id=null",
193
+ "++checkpoint.save_best_model=false",
194
+ "++checkpoint.save_final_model=true",
195
+ "++checkpoint.save_pt_file=false",
196
+ "++checkpoint.save_training_state=true",
197
+ "++checkpoint.save_safetensors_file=true",
198
+ "++checkpoint.local.keep_last_n=1",
199
+ "++checkpoint.sync.enabled=false",
200
+ "++checkpoint.sync.repo_id=null",
201
+ "++checkpoint.sync.keep_last_n=0",
202
+ "++checkpoint.sync.sync_every_n_checkpoints=1",
203
+ "++checkpoint.sync.resume_policy=local_latest",
204
+ "++run_id=demon_attack_fix_latency_6_200ep_7k2steps_single_baseline",
205
+ "++output_dir=null",
206
+ "++config_yaml=null",
207
+ "++is_debug=false",
208
+ "++version_id=0.21",
209
+ "++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints",
210
+ "++trainer.is_resume=true",
211
+ "++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/checkpoints/steps_2000_state",
212
+ "++trainer.resume_step=2000",
213
+ "++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps",
214
+ "++datasets.vla_data.data_mix=demon_attack_train__bridge",
215
+ "++datasets.vla_data.eval_data_mix=demon_attack_train__bridge__val",
216
+ "++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct",
217
+ "++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/demon_attack_fix_latency_6_200ep_7k2steps/demon_attack_train__bridge/latency_prompt_map.json"
218
+ ],
219
+ "program": "/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/starVLA/training/train_starvla_hydra.py",
220
+ "codePath": "starVLA/training/train_starvla_hydra.py",
221
+ "codePathLocal": "starVLA/training/train_starvla_hydra.py",
222
+ "git": {
223
+ "remote": "git@github.com:talha1503/starVLA.git",
224
+ "commit": "9662ad113a8910207f7a17b0faab3480c78756f1"
225
+ },
226
+ "email": "zihanwang2029@u.northwestern.edu",
227
+ "root": "/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb",
228
+ "host": "pool0-01747",
229
+ "executable": "/lustre/fsw/portfolios/nvr/users/zihwang/miniconda3/envs/starvla_rl_games_openvla/bin/python",
230
+ "cpu_count": 64,
231
+ "cpu_count_logical": 128,
232
+ "gpu": "NVIDIA H100 80GB HBM3",
233
+ "gpu_count": 2,
234
+ "disk": {
235
+ "/": {
236
+ "total": "7651200073728",
237
+ "used": "103637209088"
238
+ }
239
+ },
240
+ "memory": {
241
+ "total": "2164170448896"
242
+ },
243
+ "gpu_nvidia": [
244
+ {
245
+ "name": "NVIDIA H100 80GB HBM3",
246
+ "memoryTotal": "85520809984",
247
+ "cudaCores": 16896,
248
+ "architecture": "Hopper",
249
+ "uuid": "GPU-dfcc03b2-7c3e-32fa-5875-5af8c18ded5f"
250
+ },
251
+ {
252
+ "name": "NVIDIA H100 80GB HBM3",
253
+ "memoryTotal": "85520809984",
254
+ "cudaCores": 16896,
255
+ "architecture": "Hopper",
256
+ "uuid": "GPU-d550441f-4073-fc5f-ad55-7467c9c5df77"
257
+ }
258
+ ],
259
+ "cudaVersion": "12.2",
260
+ "slurm": {
261
+ "array_job_id": "14465987",
262
+ "array_task_count": "12",
263
+ "array_task_id": "1",
264
+ "array_task_max": "11",
265
+ "array_task_min": "0",
266
+ "array_task_step": "1",
267
+ "cluster_name": "cw-dfw-cs-001",
268
+ "conf": "/cm/shared/apps/slurm/var/etc/cw-dfw-cs-001/slurm.conf",
269
+ "cpus_on_node": "64",
270
+ "cpus_per_task": "64",
271
+ "gpus_on_node": "2",
272
+ "gtids": "0",
273
+ "job_account": "nvr_lacr_llm",
274
+ "job_cpus_per_node": "64",
275
+ "job_end_time": "1785262232",
276
+ "job_gid": "30",
277
+ "job_gpus": "1,3",
278
+ "job_id": "14468718",
279
+ "job_name": "mem-train",
280
+ "job_nodelist": "pool0-01747",
281
+ "job_num_nodes": "1",
282
+ "job_partition": "batch",
283
+ "job_qos": "normal",
284
+ "job_start_time": "1785247832",
285
+ "job_uid": "159489",
286
+ "job_user": "zihwang",
287
+ "jobid": "14468718",
288
+ "localid": "0",
289
+ "mem_per_node": "524288",
290
+ "nnodes": "1",
291
+ "nodeid": "0",
292
+ "nodelist": "pool0-01747",
293
+ "nprocs": "1",
294
+ "ntasks": "1",
295
+ "prio_process": "0",
296
+ "procid": "0",
297
+ "restart_count": "1",
298
+ "submit_dir": "/home/zihwang/projects",
299
+ "submit_host": "cw-dfw-cs-001-vscode-01",
300
+ "task_pid": "3621847",
301
+ "tasks_per_node": "1",
302
+ "topology_addr": "C1.S1.L207-DH4.pool0-01747",
303
+ "topology_addr_pattern": "switch.switch.switch.node",
304
+ "tres_per_task": "cpu=64"
305
+ },
306
+ "writerId": "7lgyqtwewd6pud81m0qoi4tyuv627zdb"
307
+ }
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/files/wandb-summary.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"_wandb":{"runtime":11901},"_step":4000,"train/loss":0.1093611866235733,"eval/demon_attack/latency_6/loss":0.09907139837741852,"timing/model":0.6215779283083975,"eval/action_loss/seconds":4.303962450940162,"_timestamp":1.7852597809327986e+09,"train/grad_norm_pre_clip":7.626007080078125,"eval/latency_6/loss":0.09907139837741852,"learning_rate/qwen_vl_interface":5.4412632155197224e-06,"eval/loss":0.09907139837741852,"eval/demon_attack/loss":0.09907139837741852,"eval/action_loss/samples":800,"_runtime":11901.344895269,"learning_rate/action_model":5.441263215519722e-05,"epoch":0.97,"timing/data":0.00025276606902480125}
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/logs/debug-core.log ADDED
@@ -0,0 +1,19 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {"time":"2026-07-28T07:12:07.167076891-07:00","level":"INFO","msg":"main: starting server","port-filename":"/tmp/tmpgc_1vayu/port-3622466.txt","pid":3622466,"detached":false,"idle-timeout":600000000000,"log-level":0,"disable-analytics":false,"shutdown-on-parent-exit":false,"enable-dcgm-profiling":false}
2
+ {"time":"2026-07-28T07:12:07.168322855-07:00","level":"INFO","msg":"server: will exit if parent process dies","ppid":3622466}
3
+ {"time":"2026-07-28T07:12:07.168263212-07:00","level":"INFO","msg":"server: accepting connections","addr":{"Name":"/tmp/wandb-3622466-3623211-175804814/socket","Net":"unix"}}
4
+ {"time":"2026-07-28T07:12:07.354272375-07:00","level":"INFO","msg":"connection: ManageConnectionData: new connection created","id":"1(@)"}
5
+ {"time":"2026-07-28T07:12:07.359629784-07:00","level":"INFO","msg":"handleInformInit: received","streamId":"800jpcpi","id":"1(@)"}
6
+ {"time":"2026-07-28T07:12:07.749040394-07:00","level":"INFO","msg":"handleInformInit: stream started","streamId":"800jpcpi","id":"1(@)"}
7
+ {"time":"2026-07-28T07:12:13.603095911-07:00","level":"INFO","msg":"connection: cancelling request","id":"1(@)","requestId":"shk0qfzn12zo"}
8
+ {"time":"2026-07-28T10:30:29.614466412-07:00","level":"INFO","msg":"connection: cancelling request","id":"1(@)","requestId":"shk0qfzn12zo"}
9
+ {"time":"2026-07-28T10:30:40.093329512-07:00","level":"INFO","msg":"connection: cancelling request","id":"1(@)","requestId":"shk0qfzn12zo"}
10
+ {"time":"2026-07-28T10:30:40.094629547-07:00","level":"INFO","msg":"handleInformFinish: finish message received","streamId":"800jpcpi","id":"1(@)"}
11
+ {"time":"2026-07-28T10:30:40.096679145-07:00","level":"INFO","msg":"handleInformFinish: stream closed","streamId":"800jpcpi","id":"1(@)"}
12
+ {"time":"2026-07-28T10:30:44.569817196-07:00","level":"INFO","msg":"handleInformTeardown: server teardown initiated","id":"1(@)"}
13
+ {"time":"2026-07-28T10:30:44.569903432-07:00","level":"INFO","msg":"connection: closing","id":"1(@)"}
14
+ {"time":"2026-07-28T10:30:44.570378487-07:00","level":"INFO","msg":"server is shutting down"}
15
+ {"time":"2026-07-28T10:30:44.570301956-07:00","level":"INFO","msg":"handleInformTeardown: server shutdown complete","id":"1(@)"}
16
+ {"time":"2026-07-28T10:30:44.570389602-07:00","level":"INFO","msg":"connection: closed successfully","id":"1(@)"}
17
+ {"time":"2026-07-28T10:30:44.570707252-07:00","level":"INFO","msg":"connection: ManageConnectionData: connection closed","id":"1(@)"}
18
+ {"time":"2026-07-28T10:30:44.571083417-07:00","level":"INFO","msg":"server: listener closed","addr":{"Name":"/tmp/wandb-3622466-3623211-175804814/socket","Net":"unix"}}
19
+ {"time":"2026-07-28T10:30:44.571391337-07:00","level":"INFO","msg":"server is closed"}
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/logs/debug-internal.log ADDED
The diff for this file is too large to render. See raw diff
 
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/logs/debug.log ADDED
@@ -0,0 +1,24 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ 2026-07-28 07:12:07,013 INFO MainThread:3622466 [wandb_setup.py:_flush():81] Current SDK version is 0.26.1
2
+ 2026-07-28 07:12:07,013 INFO MainThread:3622466 [wandb_setup.py:_flush():81] Configure stats pid to 3622466
3
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_init.py:setup_run_log_directory():723] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/logs/debug.log
5
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_init.py:setup_run_log_directory():724] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/logs/debug-internal.log
6
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_init.py:init():850] calling init triggers
7
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_init.py:init():855] wandb.init called with sweep_config: {}
8
+ config: {'_wandb': {}}
9
+ 2026-07-28 07:12:07,014 INFO MainThread:3622466 [wandb_init.py:init():898] starting backend
10
+ 2026-07-28 07:12:07,354 INFO MainThread:3622466 [wandb_init.py:init():913] sending inform_init request
11
+ 2026-07-28 07:12:07,749 INFO MainThread:3622466 [wandb_init.py:init():918] backend started and connected
12
+ 2026-07-28 07:12:07,750 INFO MainThread:3622466 [wandb_init.py:init():988] updated telemetry
13
+ 2026-07-28 07:12:07,768 INFO MainThread:3622466 [wandb_init.py:init():1011] communicating run to backend with 90.0 second timeout
14
+ 2026-07-28 07:12:08,286 INFO MainThread:3622466 [wandb_init.py:init():1056] starting run threads in backend
15
+ 2026-07-28 07:12:08,598 INFO MainThread:3622466 [wandb_run.py:_console_start():2554] atexit reg
16
+ 2026-07-28 07:12:08,598 INFO MainThread:3622466 [wandb_run.py:_redirect():2403] redirect: wrap_raw
17
+ 2026-07-28 07:12:08,598 INFO MainThread:3622466 [wandb_run.py:_redirect():2472] Wrapping output streams.
18
+ 2026-07-28 07:12:08,598 INFO MainThread:3622466 [wandb_run.py:_redirect():2495] Redirects installed.
19
+ 2026-07-28 07:12:08,602 INFO MainThread:3622466 [wandb_init.py:init():1094] run started, returning control to user process
20
+ 2026-07-28 10:30:29,609 INFO MainThread:3622466 [wandb_run.py:_finish():2321] finishing run zihanwang-ai-northwestern-university/starVLA_rl_games/800jpcpi
21
+ 2026-07-28 10:30:29,610 INFO MainThread:3622466 [wandb_run.py:_atexit_cleanup():2520] got exitcode: 0
22
+ 2026-07-28 10:30:29,611 INFO MainThread:3622466 [wandb_run.py:_restore():2502] restore
23
+ 2026-07-28 10:30:29,612 INFO MainThread:3622466 [wandb_run.py:_restore():2508] restore done
24
+ 2026-07-28 10:30:40,093 INFO MainThread:3622466 [wandb_run.py:_footer_sync_info():3889] logging synced files
demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/run-800jpcpi.wandb ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:cb35eb758506a50d1dfedb2c0ec6a3ca481cb611bade909a5ffbb289b5a5b2f8
3
+ size 8663260