arXiv cs.RO· Xuehui Yu, Eason Yu, Meiyi Wang, Haozhe Du, Stefano V. Albrecht, Harold Soh·· 2 小时前精选AI 评分71
Divide-and-Remember:面向长时程 VLA 策略的递归动作相关记忆
Divide-and-Remember: Recursive Action-Relevant Memory for Long-Horizon VLA Policies
AI 导读
论文提出 Divide-and-Remember(D&R)递归记忆方法,用于历史依赖的长时程 VLA 操作任务。该方法从模仿学习的 POMDP 表述出发,将最优记忆定义为在当前观测下最大化动作与记忆条件互信息,并把全历史选择递归拆分为 2K 个 token 中选 top-K 的子问题,所有递归块共享同一选择器。
推荐理由
论文把记忆内容当作优化问题,提出递归选择方法,并给出长时程操作基准与真机结果。
来源:arXiv cs.RO · arxiv.org