arXiv cs.RO· Yifan Li, Jiaxu Wang, Dongming Wu, Yicheng Jiang, Ryan Ji, Xiangyu Yue, Yanwei Fu·· 20 小时前精选AI 评分62
Vela:用自适应动作曲线参数化扩展视觉语言动作模型
Vela: Scaling Vision-Language-Action Models with Adaptive Action Curve Parametrization
AI 导读
Vela 是一个视觉语言动作基础模型,将未来机器人行为表示为连续轨迹,用紧凑的样条动作表示结合随运动变化的时间支撑,并通过共享动作接口适配异构本体,使固定输出预算能随运动调整时间分辨率。作者在大规模多本体机器人数据上预训练 Vela,并在 LIBERO-X、EBench 以及蛋饼烹饪和土豆切丝两个真实长程任务上评估,在仿真和物理操作中取得初步结果。
推荐理由
Vela 用样条曲线替代固定动作块表示未来轨迹,读者可了解连续动作表示如何影响时间分辨率与长程操作。
来源:arXiv cs.RO · arxiv.org