跳到正文
原文
arXiv cs.RO· Haoxuan Wang, Gengyu Zhang, Ramana Rao Kompella, Gaowen Liu, Yan Yan·· 20 小时前精选AI 评分66

TTT-RM:将测试时训练作为机器人策略的残差记忆

Test-Time Training as Residual Memory for Robot Policies

AI 导读

论文提出 TTT-RM,把测试时训练(TTT)重新用作残差记忆,用快速权重补充有界记忆库,保存无法从策略当前上下文恢复的任务相关历史信息。方法学习一个历史解码器,从当前观测和检索到的记忆中重建历史表示,重建残差作为 TTT 的学习目标,慢权重针对该残差目标优化,快速权重状态再被查询生成残差记忆表示以条件化动作生成。

推荐理由

论文把测试时训练当作残差记忆,用于长时序机器人操作,读者可了解记忆增强策略的一种新设计思路。

来源:arXiv cs.RO · arxiv.org