arXiv cs.RO· Zhe Tao, Feiran Wang, Gaowen Liu, Ramana Rao Kompella$, Yan Yan·· 20 小时前精选AI 评分71
ForeAct3D:面向 VLA 策略的策略锚定未来世界建模
ForeAct3D: Policy-Grounded Future World Modeling for VLA Policies
AI 导读
ForeAct3D 提出一种在 VLA 策略内部进行策略锚定未来世界建模的框架,用可学习几何查询从策略表征中解码深度、语义分割和相机位姿,得到当前与未来语义 3D 场景状态,未来查询以策略生成的动作块为条件。
推荐理由
论文把未来世界建模与策略动作绑定,并给出 LIBERO、CALVIN 与真机对比数据,可看方法设计与消融结论。
来源:arXiv cs.RO · arxiv.org