跳到正文

感知与导航

追踪感知与导航的研究、可复用工程方法与真实部署证据。

25条精选

最新精选

第 21–25 条 · 共 25 条
5月29日周五
  1. 阿里 Qwen 官方研究博客88

    Qwen 发布通用视觉-语言-动作模型 Qwen-VLA

    Qwen 团队发布通用视觉-语言-动作模型 Qwen-VLA,基于 Qwen 多模态骨干模型,将机器人操作与视觉语言导航统一为同一动作或轨迹预测问题,经 T2A、CPT、SFT、RL 四阶段训练产出 Qwen-VLA-Instruct。

    推荐理由:Qwen-VLA 把操作与导航统一进一个策略模型,并给出四阶段训练流程与多基准对比数据,可据此判断通用 VLA 与专项模型的差距。

11月26日周三
9月18日周四
  1. Figure 官方新闻80

    Figure 发布 Project Go-Big:Helix 实现人类视频到机器人导航的零样本迁移

    Figure 发布 Project Go-Big,为 Helix 视觉语言动作模型构建互联网规模的人形机器人预训练数据集,并与 Brookfield 合作,后者拥有全球超 10 万套住宅单元、5 亿平方英尺商业办公空间和 1.6 亿平方英尺物流空间。

    推荐理由:Figure 公布 Helix 仅用人类第一视角视频训练即可完成真实家居导航,并披露与 Brookfield 的数据采集合作规模。

6月4日周三
8月23日周三
  1. Apptronik 官方发布62

    Apptronik 发布人形机器人 Apollo

    Apptronik 发布人形机器人 Apollo,身高约 5 英尺 8 英寸、重 160 磅,可举升 55 磅,采用力控架构以保障与人协作时的安全。Apollo 支持双足行走、轮式躯干或固定安装三种模块化形态,配备可更换电池,单块续航四小时,近期面向仓储与制造场景的箱体与周转箱搬运。Apptronik 称其团队近十年间已建造超过 10 款机器人,包括参与 NASA Valkyrie 的开发。

    推荐理由:Apollo 的尺寸、负载、模块化形态与可换电池设计,为判断人形机器人进入仓储制造场景的工程取舍提供了具体参照。