arXiv cs.RO· Chenchao Sheng, Zhuang Jiang, Liuhaichen Yang, Ningwei Bai, Zezhi Tang·· 2 小时前AI 评分56
学习型纠错能否胜过简单回退?来自冻结 VLA 的证据
Does a Learned Corrector Beat a Simple Retreat? Evidence from a Frozen VLA
AI 导读
研究在冻结的 π0.5 上跨四个 RoboTwin 任务评估运行时纠错,采用配对 rollout 与同种子基座策略重跑作为安慰剂,共 3,888 对回合。完整流程仅在 beat block hammer 任务上把成功率提升 13.5 个百分点(95% 区间 [+9.4,+17.7]),其余三个任务在部署权重下未检测到增益。
来源:arXiv cs.RO · arxiv.org