跳到正文
原文
arXiv cs.RO· Jie He, Wei Li, Junwen Tong, Rui Shao, Wei-Shi Zheng, Liqiang Nie·· 3 小时前精选AI 评分62

ProAct:面向 VLA 模型的世界校准提议到动作流框架

World-Calibrated Proposal-to-Action Flow for Vision-Language-Action Models

AI 导读

ProAct 是一个世界校准的提议到动作(proposal-to-action)框架,让基于流的 VLA 策略的生成源本身变得可预测。它用轻量 Proposal Expert 将近期动作经一次运动锚定的端点流匹配转换为场景感知假设,再由前瞻 World Expert 预测任务一致的潜在未来并校准以提议为中心的各向异性源,约束每步偏差范围并分配平移、旋转与夹爪方向的细化。

推荐理由

提出以世界模型校准生成源的 VLA 策略框架,并给出相对 π0.5 的推理步数与延迟对比数据。

来源:arXiv cs.RO · arxiv.org