跳到正文
原文
arXiv cs.RO· Tingting Du, Ziyao Wang, Guoheng Sun, Ang Li·· 3 小时前AI 评分58

XGenAct:通过跨任务生成实现几何增强的世界动作模型

XGenAct: Geometry-Enhanced World Action Models through Cross-Task Generation

AI 导读

XGenAct 是一种世界动作模型,把 RGB 观测、机器人动作、度量深度、表面法线和功能角色分割统一表示为 RGB 视频,用单个视频扩散 Transformer 和一个目标函数学习跨空间的时间预测,不依赖模态专用学习头。

来源:arXiv cs.RO · arxiv.org