Files

23 lines
1.2 KiB
Markdown

# 第一代软件闭环
第一代 16DOF 软件的目标是先打通“训练、仿真验证、真机执行”闭环,而不是在初期建立复杂的分布式系统。
## 训练与策略
`05_software/train/rc_mjlab` 使用本地修改的 mjlab 和 MuJoCo 模型训练轮腿混合策略。训练任务包括 Flat、Rough 和 Crawl,腿部 12 个关节输出位置目标,4 个轮子输出速度目标。
## MuJoCo 与 Sim2Sim
- `mujoco_sim` 用于不加载 RL 策略时的模型、动力学和控制调试。
- `sim2sim` 加载训练策略,在独立 MuJoCo 环境中验证观测、动作、地形和导航行为。
- 两者与训练任务共同使用 `rc_mjlab/mjcf`,避免早期模型定义不一致。
## 真机控制
- `ik_real` 先以逆运动学和轨迹插值验证电机控制链路。
- `sim2real` 再将训练策略部署到 Python 真机运行时,加入 IMU、站立、安全和 Web 调试。
## 阶段特点
这一版本的优势是链路完整、模块直观,便于快速验证;局限是训练、仿真和部署仍存在重复资源,Python 真机运行时的实时性和系统集成能力有限。这些问题推动了后续统一训练版本和 ROS 2/C++ 部署架构。