yangzhaofeng/guangmokuai
Viewer • Updated • 48 • 627
How to use yangzhaofeng/guangmokuai with LeRobot:
本模型集合收录了基于 LeRobot 0.4.4 训练的多个 ACT 策略模型。所有模型均训练 100,000 步,支持多相机视觉输入和触觉传感器数据。训练所用数据集包含千觉传感器和戴盟传感器的数据集集合。
| 模型位置 | policy | 数据集 | 版本 | 训练步数 | 输入 | 成功率 |
|---|---|---|---|---|---|---|
| qj_100 (desperate) |
共享ACT | qj_100 (desperate) |
0.4.4 | 100k | 3 相机 +robot state |
9% |
| qj_150 (desperate) |
共享ACT | qj_jiaozheng_50+qj_100 (desperate) |
0.4.4 | 100k | 3 相机 +robot state |
18% |
| qj_200 (desperate) |
共享ACT | qj_200(100+100) (desperate) |
0.4.4 | 100k | 3 相机 +robot state |
6% |
| qj_100_reinforce (desperate) |
共享ACT+图像增强 | qj_100(1) (desperate) |
0.4.4 | 100k | 3 相机 + robot state |
42% |
| qj_300_reinforce (desperate) |
共享ACT+图像增强 | qj_300 (desperate) |
0.4.4 | 100k | 3 相机 + robot state |
60% |
| qj_act_50 reinforce |
共享ACT+图像增强 | qj_50 | 0.4.4 | 100k | 3 相机 + robot state |
% |
| 模型位置 | policy | 数据集 | 版本 | 训练步数 | 输入 | 成功率 |
|---|---|---|---|---|---|---|
| dm_act_100 (desperate) |
独立ACT | dm_100 (desperate) |
0.4.4 | 100k | 3 相机 + distforce + robot state |
17% |
| dm_act_tac_100 (desperate) |
独立ACT+触觉 | dm_100 (desperate) |
0.4.4 | 100k | 3 相机 + distforce + robot state |
--- |
| dm_act_orin_100 (desperate) |
共享ACT | dm_100 (desperate) |
0.4.4 | 100k | 3 相机 + robot state |
42% |
| dm_act_orin_tac_100 (desperate) |
共享ACT+触觉 | dm_100 (desperate) |
0.4.4 | 100k | 3 相机 + distforce + robot state |
30% |
| dm_act_200 (desperate) |
独立ACT | dm_200 (desperate) |
0.4.4 | 100k | 3 相机 + distforce + robot state |
--- |
| dm_act_tac_200 (desperate) |
独立ACT+触觉 | dm_200 (desperate) |
0.4.4 | 100k | 3 相机 + distforce + robot state |
--- |
| dm_act_orin_200 (desperate) |
共享ACT | dm_200 (desperate) |
0.4.4 | 100k | 3 相机 + robot state |
26% |
| dm_act_orin_tac_200 (desperate) |
共享ACT+触觉 | dm_200 (desperate) |
0.4.4 | 100k | 3 相机 +distforce + robot state |
--- |
| dm_act_orin_350 (desperate) |
共享ACT | dm_350 (desperate) |
0.4.4 | 100k | 3 相机 + robot state |
62% |
| dm_act_orin_350 reinforce(desperate) |
共享ACT+图像增强 | dm_350 (desperate) |
0.4.4 | 100k | 3 相机 + robot state |
83% |
| dm_act_orin_500 (desperate) |
共享ACT | dm_500 (desperate) |
0.4.4 | 100k | 3 相机 + robot state |
15% |
| dm_act_orin_500 reinforce(desperate) |
共享ACT+图像增强 | dm_500 (desperate) |
0.4.4 | 100k | 3 相机 + robot state |
26% |
| dm_act_orin_200 reinforce |
共享ACT+图像增强 | dm_200 | 0.4.4 | 100k | 3 相机 + robot state |
66% |
| dm_act_orin_350 reinforce |
共享ACT+图像增强 | dm_350 | 0.4.4 | 100k | 3 相机 + robot state |
64% |
| dm_act_orin_350+50 reinforce |
共享ACT+图像增强 | dm_350+50 | 0.4.4 | 100k | 3 相机 + robot state |
% |
每个模型检查点包含:
model_name/
├── checkpoints/
│ ├── pretrained_model/
│ │ ├── config.json # 模型配置
│ │ ├── model.safetensors # 模型权重
│ │ ├── policy_preprocessor.json # 预处理器配置
│ │ ├── policy_preprocessor_step_3_normalizer_processor.safetensors
│ │ ├── policy_postprocessor.json
│ │ ├── policy_postprocessor_step_0_unnormalizer_processor.safetensors
│ │ └── train_config.json # 训练配置
│ └── training_state/
│ ├── optimizer_state.safetensors
│ ├── optimizer_param_groups.json
│ ├── rng_state.safetensors
│ ├── scheduler_state.json # (部分模型)
│ └── training_step.json
└── wandb/ # 训练日志