跳到正文
原文
arXiv cs.RO· Mingyu Liu, Chonghao Sima, Tianjian Feng, Hanqing Wang, Cong Chen, Hao Chen, Chunhua Shen·· 20 小时前精选AI 评分62

PerturBot:用扰动训练打破 VLA 模型的捷径先验

PerturBot: Breaking Shortcut Priors in Vision-Language-Action Models with Perturbative Training

AI 导读

论文提出 PerturBot,通过任务保持的手腕视角扰动、加入决策相关描述的指令,以及重标注的随机与失败轨迹片段,让任务相关证据更易被使用、使捷径不再充分,且不改变推理过程。作者同时提出离线指标 GroundingFscore,用于诊断策略对模态捷径的依赖程度,与任务成功率互补,判断策略是否健康扩展。该方法面向视觉语言动作策略中视觉、词汇与动作层面的捷径依赖问题。

推荐理由

针对 VLA 策略依赖模态捷径的问题,提出训练扰动方法与离线诊断指标,可迁移到现有训练流程。

来源:arXiv cs.RO · arxiv.org