Figure 官方新闻·· 2025-03-25精选AI 评分74
Figure 用强化学习训练 Figure 02 自然行走控制器
Natural Humanoid Walk Using Reinforcement Learning
AI 导读
Figure 发布用端到端强化学习训练的人形行走控制器,在 GPU 加速物理仿真中并行模拟数千台 Figure 02,数小时生成数年仿真数据。该策略结合域随机化与机器人上 kHz 级力矩反馈闭环控制,无需额外微调即可零样本迁移到真机,并让 10 台 Figure 02 运行同一网络。训练中通过奖励机器人模仿人类行走参考轨迹,保留脚跟着地、脚尖离地和摆臂等步态特征。
推荐理由
Figure 公开了纯仿真强化学习训练的人形行走控制器,并说明零样本迁移到 Figure 02 真机的做法。
来源:Figure 官方新闻 · figure.ai