跳到正文
原文
arXiv cs.RO· Yuzhi Zhang, Xinyu Liu, Yu Zhang·· 21 小时前AI 评分58

通过局部恢复监督实现视觉运动策略的递归自我改进

Recursive Self-Improvement of Visuomotor Policies through Local Recovery Supervision

AI 导读

论文提出一种通过局部恢复监督让视觉运动策略递归自我改进的框架:每轮审计当前策略,在受支持的失败状态生成纠正示范并更新策略,用于下一轮采集。

来源:arXiv cs.RO · arxiv.org