跳到正文
原文
HF blog·· 2026-07-20精选AI 评分60

See like a Robot:面向 VLA 的机器人中心点图

Paper page - See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models

AI 导读

论文提出机器人中心点图(robot-centric pointmaps),像素存储场景点在机器人坐标系下的三维坐标,从而对齐视觉观测与机器人坐标系动作,缓解 VLA 中相机视角与动作定义之间的坐标系错配。

推荐理由

论文提出以机器人坐标系点图替代相机视角输入,读者可了解跨视角泛化在仿真与真机上的验证方式。

来源:HF blog · huggingface.co