Views
No views yet
| 模型位置 | policy | 数据集 | 版本 | 训练步数 | 输入 | 成功率 |
|---|---|---|---|---|---|---|
| qj_100 (desperate) | 共享ACT | qj_100 (desperate) | 0.4.4 | 100k | 3 相机 +robot state | 9% |
| qj_150 (desperate) | 共享ACT | qj_jiaozheng_50+qj_100 (desperate) | 0.4.4 | 100k | 3 相机 +robot state | 18% |
| qj_200 (desperate) | 共享ACT | qj_200(100+100) (desperate) | 0.4.4 | 100k | 3 相机 +robot state | 6% |
| qj_100_reinforce (desperate) | 共享ACT+图像增强 | qj_100(1) (desperate) | 0.4.4 | 100k | 3 相机 + robot state | 42% |
| qj_300_reinforce (desperate) | 共享ACT+图像增强 | qj_300 (desperate) | 0.4.4 | 100k | 3 相机 + robot state | 60% |
| qj_50_reinforce (desperate) | 共享ACT+图像增强 | qj_50 (desperate) | 0.4.4 | 100k | 3 相机 + robot state | --- |
model_name/
├── checkpoints/
│ ├── pretrained_model/
│ │ ├── config.json # 模型配置
│ │ ├── model.safetensors # 模型权重
│ │ ├── policy_preprocessor.json # 预处理器配置
│ │ ├── policy_preprocessor_step_3_normalizer_processor.safetensors
│ │ ├── policy_postprocessor.json
│ │ ├── policy_postprocessor_step_0_unnormalizer_processor.safetensors
│ │ └── train_config.json # 训练配置
│ └── training_state/
│ ├── optimizer_state.safetensors
│ ├── optimizer_param_groups.json
│ ├── rng_state.safetensors
│ ├── scheduler_state.json # (部分模型)
│ └── training_step.json
└── wandb/ # 训练日志