arXiv cs.RO· Yuchen Zhu, Chenyi Xu, Yulin Zhang, Gang Xu, Wentao Zhu·· 2 小时前精选AI 评分71
Juno:为视觉语言动作模型驯服预测性潜变量
Juno: Taming Predictive Latents for Vision-Language-Action Models
AI 导读
Juno 是一个围绕动作条件 JEPA 构建的统一框架,将其同时用作控制对齐的表示骨干、预测教师和可适配动力学模型,以解决与具身控制不匹配、干扰动作学习和分布偏移下教师失准三类问题。
推荐理由
Juno 把动作条件 JEPA 同时用作表示骨干、预测教师和可适配世界模型,读者可了解其预训练与部署对齐思路。
来源:arXiv cs.RO · arxiv.org