1.2 KiB
1.2 KiB
第一代软件闭环
第一代 16DOF 软件的目标是先打通“训练、仿真验证、真机执行”闭环,而不是在初期建立复杂的分布式系统。
训练与策略
05_software/train/rc_mjlab 使用本地修改的 mjlab 和 MuJoCo 模型训练轮腿混合策略。训练任务包括 Flat、Rough 和 Crawl,腿部 12 个关节输出位置目标,4 个轮子输出速度目标。
MuJoCo 与 Sim2Sim
mujoco_sim用于不加载 RL 策略时的模型、动力学和控制调试。sim2sim加载训练策略,在独立 MuJoCo 环境中验证观测、动作、地形和导航行为。- 两者与训练任务共同使用
rc_mjlab/mjcf,避免早期模型定义不一致。
真机控制
ik_real先以逆运动学和轨迹插值验证电机控制链路。sim2real再将训练策略部署到 Python 真机运行时,加入 IMU、站立、安全和 Web 调试。
阶段特点
这一版本的优势是链路完整、模块直观,便于快速验证;局限是训练、仿真和部署仍存在重复资源,Python 真机运行时的实时性和系统集成能力有限。这些问题推动了后续统一训练版本和 ROS 2/C++ 部署架构。