跳到正文
原文
arXiv cs.RO· Jieting Long, Weidong Cai, Weiming Zhi·· 3 小时前AI 评分44

RRDF:为视觉运动模仿策略重新布线易走捷径的观测融合

Register-Routed Delayed Fusion: Rewiring Shortcut-Prone Observation Fusion in Visuomotor Imitation

AI 导读

针对视觉运动模仿策略中视觉 token 可直接关注紧凑 token 的融合拓扑问题,作者提出 Register-Routed Delayed Fusion(RRDF),通过掩蔽直接紧凑-视觉注意力并借助可学习 register 工作区分阶段进行跨模态交互。

来源:arXiv cs.RO · arxiv.org