random_new / config.yaml
SleepMastger's picture
Add README, config, dataset_stats
a73ed65 verified
Raw
History Blame Contribute Delete
4.84 kB
output_dir: /shared_work/george/runs/pcbnew_flashwam_ft/2026-07-26_04-20-25
batch_size: 8
num_workers: 12
lr_scheduler_type: cosine
learning_rate: 0.0001
num_epochs: 30
max_steps: null
log_every: 10
save_every: 8060
eval_every: 0
eval_num_inference_steps: 10
gradient_accumulation_steps: 1
mixed_precision: bf16
distributed_timeout_minutes: 60
seed: 42
max_grad_norm: 1.0
weight_decay: 0.01
resume: /shared_work/george/place_cube_train/checkpoints/M1_FusedKV_RopeFixed_step021700_newformat.pt
freeze_video_backbone: false
hf_upload:
enabled: false
dry_run: false
fail_on_error: false
script_path: huggingface/upload_to_hf.sh
bucket_run_name: null
wandb:
enabled: true
workspace: huaweiwam
project: fastwam-realrobot
name: pcbnew_flashwam_ft_2026-07-26_04-20-25
group: null
mode: online
data:
train:
_target_: fastwam.datasets.lerobot.robot_video_dataset.RobotVideoDataset
dataset_dirs:
- /dev/shm/place_cube_new_lerobot_v21
shape_meta:
images:
- key: image
raw_shape:
- 3
- 256
- 256
shape:
- 3
- 224
- 224
- key: wrist_image
raw_shape:
- 3
- 256
- 256
shape:
- 3
- 224
- 224
action:
- key: default
raw_shape: 7
shape: 7
state:
- key: default
raw_shape: 8
shape: 8
num_frames: 33
global_sample_stride: 1
action_video_freq_ratio: 4
video_size:
- 224
- 448
camera_key: null
val_set_proportion: 0.0
is_training_set: true
skip_padding_as_possible: false
concat_multi_camera: horizontal
processor:
_target_: fastwam.datasets.lerobot.processors.fastwam_processor.FastWAMProcessor
shape_meta:
images:
- key: image
raw_shape:
- 3
- 256
- 256
shape:
- 3
- 224
- 224
- key: wrist_image
raw_shape:
- 3
- 256
- 256
shape:
- 3
- 224
- 224
action:
- key: default
raw_shape: 7
shape: 7
state:
- key: default
raw_shape: 8
shape: 8
num_obs_steps: 33
num_output_cameras: 2
action_output_dim: 7
proprio_output_dim: 8
delta_action_dim_mask:
default:
- true
- true
- true
- true
- true
- true
- false
action_state_transforms: null
use_stepwise_action_norm: false
norm_default_mode: min/max
norm_exception_mode: null
action_state_merger:
_target_: fastwam.datasets.lerobot.transforms.action_state_merger.ConcatLeftAlign
train_transforms:
- _target_: fastwam.datasets.lerobot.transforms.image.ToTensor
- _target_: torchvision.transforms.Resize
size:
- 224
- 224
val_transforms:
- _target_: fastwam.datasets.lerobot.transforms.image.ToTensor
- _target_: torchvision.transforms.Resize
size:
- 224
- 224
text_embedding_cache_dir: /dev/shm/place_cube_text_embeds_cache
context_len: 128
model:
_target_: fastwam.models.wan22.fasterwam_decoupled.create_fasterwam_decoupled
model_id: Wan-AI/Wan2.2-TI2V-5B
tokenizer_model_id: Wan-AI/Wan2.1-T2V-1.3B
tokenizer_max_len: 128
load_text_encoder: false
proprio_dim: 8
redirect_common_files: true
mot_checkpoint_mixed_attn: false
action_dit_pretrained_path: null
skip_dit_load_from_pretrain: false
decoupled: true
kv_source_mode: fused_kv
fusion_hidden_dim: 64
fusion_use_norm: true
fixed_rope: true
video_dit_config:
has_image_input: false
patch_size:
- 1
- 2
- 2
in_dim: 48
hidden_dim: 3072
ffn_dim: 14336
freq_dim: 256
text_dim: 4096
out_dim: 48
num_heads: 24
attn_head_dim: 128
num_layers: 30
eps: 1.0e-06
seperated_timestep: true
require_clip_embedding: false
require_vae_embedding: false
fuse_vae_embedding_in_latents: true
use_gradient_checkpointing: false
video_attention_mask_mode: first_frame_causal
action_conditioned: false
action_dim: 7
action_group_causal_mask_mode: group_diagonal
action_dit_config:
action_dim: 7
hidden_dim: 1024
ffn_dim: 4096
num_heads: 24
attn_head_dim: 128
num_layers: 1
layer_selected: null
text_dim: 4096
freq_dim: 256
eps: 1.0e-06
use_gradient_checkpointing: false
action_text_cross_attn: true
video_scheduler:
train_shift: 5.0
infer_shift: 5.0
num_train_timesteps: 1000
action_scheduler:
train_shift: 5.0
infer_shift: 5.0
num_train_timesteps: 1000
loss:
lambda_video: 1.0
lambda_action: 1.0