arXiv cs.RO· Shangyuan Yuan, Xinda Qi, Yujiang Pu, Wenliang Guo, Xiaobo Tan·· 2 小时前精选AI 评分62
StairVLA:面向 VLA 模型的分阶段分层动作生成框架
StairVLA: Stage-Aware Hierarchical Action Generation for Vision-Language-Action Models
AI 导读
StairVLA 是一个分阶段感知的分层动作生成框架,用部分去噪动作作为高层长时程动作生成与局部精修之间的接口:高层 VLA 执行早期去噪产出可复用的长时程部分去噪动作轨迹,轻量精修器以更高频率结合最新观测精修局部动作块。
推荐理由
论文提出按去噪阶段分层生成动作的 VLA 框架,并给出 LIBERO 上的成功率与推理延迟对比数据。
来源:arXiv cs.RO · arxiv.org