跳到正文
原文
arXiv cs.RO· Taegeun Yang, Youngju Na, Yoonki Cho, Sung-Eui Yoon·· 2 小时前精选AI 评分62

Same Scene, Different Task:面向 VLA 组合泛化的技能对齐方法 CRAFT

Same Scene, Different Task: Skill Alignment for Compositional Generalization in VLAs

AI 导读

论文提出 CRAFT,用于解决 VLA 模型难以泛化到微调示范中未出现的技能组合问题。作者将失败归因于视觉捷径,即视觉观测在微调中充当指令代理,使策略执行与相似观测关联的已演示组合而非指令组合;CRAFT 通过固定示范观测、改变指令构造反事实配对,并借助可跨执行复用的技能表示,把已演示执行的监督迁移到这些配对上。

推荐理由

针对 VLA 在未演示技能组合上的泛化失败,提出用反事实配对迁移监督的 CRAFT 方法,并在三个模型、两个仿真基准和真机上验证。

来源:arXiv cs.RO · arxiv.org