热点事件持续更新
XGenAct:几何增强世界动作模型
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
2026年10月5日,arXiv cs.RO 刊出 XGenAct 相关报道,提出一种几何增强的世界动作模型。该模型将 RGB 观测、机器人动作、度量深度、表面法线和功能角色分割统一表示为 RGB 视频,并用单个视频扩散 Transformer 与一个目标函数学习跨空间的时间预测,不依赖模态专用学习头。目前报道仅介绍其方法设计,未提及实验、评测或对比结果,事件进展限于模型提出本身。
AI 根据报道生成 · 2 小时前更新
最新进展10月5日 12:00
XGenAct 提出用单一视频扩散 Transformer 统一建模 RGB、动作与几何信息。报道时间线
沿着报道,了解事件的不同侧面。
10月5日
- arXiv cs.ROXGenAct:通过跨任务生成实现几何增强的世界动作模型
XGenAct 是一种世界动作模型,把 RGB 观测、机器人动作、度量深度、表面法线和功能角色分割统一表示为 RGB 视频,用单个视频扩散 Transformer 和一个目标函数学习跨空间的时间预测,不依赖模态专用学习头。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。