Files

1.2 KiB

第一代软件闭环

第一代 16DOF 软件的目标是先打通“训练、仿真验证、真机执行”闭环,而不是在初期建立复杂的分布式系统。

训练与策略

05_software/train/rc_mjlab 使用本地修改的 mjlab 和 MuJoCo 模型训练轮腿混合策略。训练任务包括 Flat、Rough 和 Crawl,腿部 12 个关节输出位置目标,4 个轮子输出速度目标。

MuJoCo 与 Sim2Sim

  • mujoco_sim 用于不加载 RL 策略时的模型、动力学和控制调试。
  • sim2sim 加载训练策略,在独立 MuJoCo 环境中验证观测、动作、地形和导航行为。
  • 两者与训练任务共同使用 rc_mjlab/mjcf,避免早期模型定义不一致。

真机控制

  • ik_real 先以逆运动学和轨迹插值验证电机控制链路。
  • sim2real 再将训练策略部署到 Python 真机运行时,加入 IMU、站立、安全和 Web 调试。

阶段特点

这一版本的优势是链路完整、模块直观,便于快速验证;局限是训练、仿真和部署仍存在重复资源,Python 真机运行时的实时性和系统集成能力有限。这些问题推动了后续统一训练版本和 ROS 2/C++ 部署架构。