arXiv cs.RO· Shukai Gong, Xuanran Zhai, Yintianrun Zhang, Ruopeng Cui, Ye Huang, Yiyang Fu, Dexuan Lyu, Chaojie Li, Xinyi Song, Peiwen Lin, Chuang Wang, Mingyuan Jia, Yufan Deng, Jiaxin Fang, Bo Liang, Jiaxin Li, Yuxiang Gao, Hao Liu, Daquan Zhou·· 3 小时前精选AI 评分62
ViGAR:面向组合与上下文机器人操作的分层世界动作模型
Rethinking World-Action Model for Compositional and In-Context Robotic Manipulation
AI 导读
论文提出 Visual Goal-conditioned Action Reasoning(ViGAR),将操作分解为视觉子目标规划器和子目标执行器,两者共享预训练世界模型表征,支持任务级规划与动作生成。
推荐理由
论文提出分层世界动作模型 ViGAR,用视觉子目标规划器与执行器共享世界模型表征,读者可了解长程组合操作的一种新分解思路。
来源:arXiv cs.RO · arxiv.org