HF blog·· 2026-07-20精选AI 评分60
See like a Robot:面向 VLA 的机器人中心点图
Paper page - See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models
AI 导读
论文提出机器人中心点图(robot-centric pointmaps),像素存储场景点在机器人坐标系下的三维坐标,从而对齐视觉观测与机器人坐标系动作,缓解 VLA 中相机视角与动作定义之间的坐标系错配。
推荐理由
论文提出以机器人坐标系点图替代相机视角输入,读者可了解跨视角泛化在仿真与真机上的验证方式。
来源:HF blog · huggingface.co