跳到正文
原文
Figure 官方新闻·· 2025-03-25精选AI 评分74

Figure 用强化学习训练 Figure 02 自然行走控制器

Natural Humanoid Walk Using Reinforcement Learning

AI 导读

Figure 发布用端到端强化学习训练的人形行走控制器,在 GPU 加速物理仿真中并行模拟数千台 Figure 02,数小时生成数年仿真数据。该策略结合域随机化与机器人上 kHz 级力矩反馈闭环控制,无需额外微调即可零样本迁移到真机,并让 10 台 Figure 02 运行同一网络。训练中通过奖励机器人模仿人类行走参考轨迹,保留脚跟着地、脚尖离地和摆臂等步态特征。

推荐理由

Figure 公开了纯仿真强化学习训练的人形行走控制器,并说明零样本迁移到 Figure 02 真机的做法。

来源:Figure 官方新闻 · figure.ai