NVIDIA Halos for Robotics:面向物理 AI 的全栈功能安全系统
NVIDIA 推出 Halos for Robotics 全栈功能安全系统,面向在工厂、仓库、医院和家庭中与人自主共处的物理 AI 机器人。该系统针对机器人走出围栏、环境愈发非结构化后传统安全方案失效的问题,以 AI 驱动的安全为核心。NVIDIA 称这是物理 AI 到来过程中的一个重要里程碑。
NVIDIA 推出 Halos for Robotics 全栈功能安全系统,面向在工厂、仓库、医院和家庭中与人自主共处的物理 AI 机器人。该系统针对机器人走出围栏、环境愈发非结构化后传统安全方案失效的问题,以 AI 驱动的安全为核心。NVIDIA 称这是物理 AI 到来过程中的一个重要里程碑。
AURA Foresight 从全球 130 多支队伍中入围 XPRIZE Wildfire 自主野火响应赛道决赛,成为仅剩的四支队伍之一。该系统结合固定传感器、AI 与自主飞行机器人集群,在 1000 km² 范围内实现探测、核实与干预,目标在十分钟内响应火情。决赛将在阿拉斯加 Nenana 举行,团队与英国、加拿大和澳大利亚的消防部门合作开发。
Robot Talk 第161期对话斯坦福大学 Allison Okamura,讨论面向触觉交互的先进机器人系统开发。Okamura 是斯坦福大学 Richard W. Weiland 工程学教授,研究兴趣涵盖触觉、遥操作、虚拟现实、医疗机器人、软体机器人、康复与教育,并担任斯坦福机器人中心创始教员及执行委员会成员。
Open Robotics 的 gz-sim 发布 8.14.0 版本,由 azeey 打上 gz-sim8_8.14.0 标签,提交 4ada862 已通过 GitHub 签名验证。该提交标题为“Prepare for 8.14.0”,随附 2 个资源文件。
ROS 2 Jazzy Jalisco 补丁版本 8 发布二进制包,提供 Ubuntu 24.04(Noble)的 Debian 包和 RHEL 9 的 RPM 包。因 Windows 10 已 EOL,本次补丁版本不再包含 Windows 二进制包。安装前需确保系统已更新,源码链接为 GitHub 自动生成,不含 ROS 2 源代码。
ROS 2 Jazzy Jalisco 补丁版本 7 发布,提供 Ubuntu 24.04(Noble)的 Debian 包和 RHEL 9 的 RPM 包,系统需保持最新才能兼容下载的包。GitHub 自动生成的源码链接不含 ROS 2 源代码,如需从源码构建请参考官方构建说明。
Fast DDS v3.4.3 发布,这是 3.4.x 分支的最后一个版本,该分支已到达 EOL。此补丁版本修复了 CVE-2026-22591、CVE-2026-45094 等 9 个安全漏洞,并修复了 RTPSParticipantAttributes 内部数据竞争、空指针解引用、默认 locator 更新错误等问题,同时使 on_xxx_matched 线程安全。
MIT 与宾夕法尼亚大学的研究者提出开源轨迹规划系统 MIGHTY,让无人机在毫秒级响应障碍的同时保持平滑航线并缩短飞行时间。该系统用 Hermite 样条把飞行时间与路径放在一步内联合优化,并借助激光雷达地图迭代细化初始轨迹,仅靠机载计算与传感器即可实时飞行。
Isaac Lab 3.0 Beta 2 发布,作为 3.0 beta 的稳定化版本,兼容 Isaac Sim 6.0.0,扩展了 Newton 支持(VBD、求解器耦合、Kamino、崎岖地形、传感器)与多后端物理,并简化训练和安装命令。
推荐理由:Isaac Lab 3.0 Beta 2 汇总了多后端物理、Newton 与无 Kit 工作流的改动,可据此判断升级与迁移成本。
Qwen 发布 Qwen-Robot Suite 具身基础模型套件,包含 Qwen-RobotNav、Qwen-RobotManip 与 Qwen-RobotWorld 三个基础模型,分别将语言与导航、操作、世界动力学预测对齐。
推荐理由:Qwen 一次性发布导航、操作与世界模型三件套,并给出跨本体对齐与开源数据规模的训练细节,可据此判断其技术路线。
阿里 Qwen 团队发布 Qwen-RobotNav,一个基于 Qwen3-VL 构建的规模化导航模型,在 1560 万条样本上训练,用单组权重统一 VLN、目标搜索、目标跟踪、自动驾驶与具身问答五类任务。
推荐理由:原文给出统一五类导航任务的单权重模型与可控观测接口,读者可据此判断导航模型作为智能体原语的可行路径。
Qwen 团队发布通用视觉-语言-动作基础模型 Qwen-RobotManip,基于 Qwen-VL 构建,仅用开源机器人数据集和人类演示视频、不依赖私有采集,构建了超过 38,100 小时的预训练语料,覆盖 15 个本体。
推荐理由:Qwen-RobotManip 用统一跨构型对齐把开源数据扩到 38K 小时,读者可据此判断 VLA 规模化的可行路径。
Qwen 团队发布 Qwen-RobotWorld 具身世界模型,以自然语言作为统一动作接口,将操作、自动驾驶与室内导航纳入同一模型联合训练。模型采用双流 MMDiT 架构,理解流用冻结的 Qwen2.5-VL 编码语言动作,生成流处理视频 VAE 隐变量,两条流逐层联合注意力交互。
推荐理由:Qwen-RobotWorld 用自然语言统一操作、驾驶与导航的动作接口,读者可了解其双流扩散架构与跨构型泛化思路。
NVIDIA 提出世界动作模型(WAM)概念,指从预训练世界模型或视频模型出发、再微调为机器人策略的一类模型,与从 VLM 骨干起步的 VLA 形成对照。文中以 Pi-0 和 GR00T N1 作为 VLA 的代表案例。
康奈尔大学工程师研发出 Cross-Link Collective 机器人集体,由数十个长约 200 毫米、宽约 20 毫米的模块组成,每个模块内置小电机在 I 形和 U 形之间振荡,两端有弱魔术贴可临时连接相邻模块,相关研究 5 月 20 日发表于 Science Robotics。
Robot Talk 第160期对话 Machina Labs 联合创始人兼 CEO Edward Mehr,讨论其 RoboCraftsman 如何为航空航天、国防和汽车行业成形复杂金属零件。Machina Labs 致力于将 AI 驱动机器人集成到灵活、按需的生产系统中,重塑金属成形与现代制造方式。
openEuler 社区孵化的具身智能 OS 技术栈 IB-Robot 发布实时多模型调度组件 Inference Scheduler,负责在多个异构模型间做选择,让推理链路跟上控制节奏。
推荐理由:原文拆解了 IB-Robot 多模型调度的分层架构与 InferScore 评分维度,可供做端侧推理编排的团队参考。
NVIDIA 在 GTC Taipei 上披露多项 robotaxi 合作:Uber 与 Autobrains 在慕尼黑基于 NVIDIA Hyperion 平台启动 robotaxi 项目,Foxconn 扩大合作在台湾部署车队,VinFast 与 Autobrains 面向东南亚推 L4 车辆,HUMAIN 则将 Hyperion 方案引入沙特。
Open Robotics 为 Ignition Gazebo 6 打上 ignition-gazebo6_6.18.0 标签,提交由 Addisu Z. Taddese 签署,版本进入 6.18.0 准备阶段。
Google DeepMind 推出为期三个月的机器人加速器项目,从欧洲选出 15 家早期机器人初创公司,提供技术指导、产品辅导及 Gemini 机器人模型等 AI 资源支持。入选企业覆盖物流、制造、医疗、气候与导航等领域,包括开发机器人焊接平台的 3D-Components、做自主水下机器人的 Bubble Robotics、研发神经外科微机器人的 ROBEAUTE 等。
AAMAS 2026 最佳论文奖授予 Mireia Yurrita 等人的《Developing Guidelines for Human-LLM Agent Teams: A Multi-Stakeholder Lens》。
openEuler 社区 2026 年 5 月运作报告显示,截至 5 月底社区累计用户超过 711 万、开发者超过 2.7 万,单位成员达 2157 家。基于 openEuler 的宇航级嵌入式星载操作系统首次在商业卫星载荷领域实现实际在轨运行,社区同期在 KADC 2026 展示 IB-Robot 具身智能 AI 软件栈的人形机器人数据采集与自主抓取能力。
NVIDIA 与斗山集团扩大合作,覆盖斗山机器人、斗山山猫、斗山恒能和斗山电子材料 BG,将 NVIDIA 全栈加速计算平台与斗山工业自动化、发电和电子材料能力结合。
Robot Talk 第159期对话赫瑞瓦特大学助理教授 Maria Koskinopoulou,主题为机器人感知与操作。她与 Ignacio Carlucho 共同领导该校及国家机器人馆的 ARM²Lab(自主机器人操作与多智能体系统实验室),研究涵盖机器人操作、感知、机器人视觉、医疗机器人、人机交互与机器学习。
Open Robotics 发布 Gazebo 仿真器 gz-sim 10.4.0 版本,提交由 Arjo Chakravarty 签署,Steve Peters 参与协作。该版本为 gz-sim10 分支的 10.4.0 发布准备提交。
1X 宣布成立 1X World Model Lab,专注通过大规模具身世界模型预训练加速全自主人形机器人研发,并任命前 Luma AI 创始研究科学家 Sam Sinha 为创始 AI 研究员兼世界模型负责人。
NVIDIA Research 在 CVPR 展示三篇论文:首个零样本抓取基础模型 GraspGen-X 基于 20 亿次仿真抓取训练,可为未见过的夹爪和物体生成抓取位姿。
推荐理由:三篇论文分别覆盖零样本抓取、自动驾驶推理加速与虚拟环境智能体训练,可了解规模化训练如何提升跨场景泛化。
NVIDIA 在 CVPR 发布面向物理 AI 研究的 agent skills,帮助研究者自动化自动驾驶、机器人和视觉 AI 的开发流程。
推荐理由:NVIDIA 在 CVPR 发布面向物理 AI 的 agent skills,读者可了解其覆盖自动驾驶、视觉 AI 与机器人学习的工具链与开放入口。
加州大学圣地亚哥分校计算机科学与工程教授 Henrik I. Christensen 发布了一份全球机器人技术路线图,聚焦亚洲、欧洲和美洲,梳理机器人技术现状与主要机会,覆盖 2025–2035 年。
NVIDIA 在 COMPUTEX 上宣布 NVIDIA JetPack 7.2 与 NVIDIA NemoClaw 支持 NVIDIA Jetson,将智能体 AI 框架落到生产级 Jetson 软件栈上。
推荐理由:JetPack 7.2 与 NemoClaw 在 Jetson 上的组合给出了边缘智能体的部署路径,读者可据此判断现有机器人栈的升级方向。
NVIDIA JetPack 7.2 支持一条命令部署开源栈 NVIDIA NemoClaw,为 OpenClaw 增加隐私与安全控制。该版本还引入面向 Jetson 的 NVIDIA agent skills,通过优化内存与性能加速 AI 智能体在物理环境中的实际部署。
NVIDIA 在 GTC Taipei 上发布 Factory Operations Blueprint(FOX),一套用于构建自主工厂管理智能体的参考设计,可连接机器信号、质量系统与机器人集群,并编排质检、物料运输与工人安全等专用智能体。
推荐理由:NVIDIA 公布工厂运营蓝图 FOX 的参考设计与首批落地案例,可了解工厂管理智能体的构建方式与部署路径。
NVIDIA 介绍用 Alpamayo 对自动驾驶车辆模型进行闭环后训练,以弥合训练与部署之间的差距。可推理复杂驾驶场景的 VLA 模型目前主要在开环下训练,模型输出直接与真值行为比较,不考虑其对环境的影响。
NVIDIA 发布面向物理 AI 的前沿基础模型 Cosmos 3,结合物理推理能力。该模型面向机器人、自动驾驶和智能空间,用于理解现实世界、预测后续变化并生成针对特定环境、本体和任务的动作。
推荐理由:NVIDIA 发布面向物理 AI 的前沿基础模型 Cosmos 3,读者可了解其推理、世界与动作模型的定位。
宇树宣布推出 H2 Plus,这是面向学术研究的 NVIDIA Isaac GR00T 参考人形机器人。宇树同时展示了四足机器人电力智能巡检方案,针对危险、紧急和重复性任务设计,为电力系统建设与运维提供保障。
宇树 SFG 机器人在马年以“赛博真功夫”形式亮相,将功夫与春天元素结合。宇树同时推出四足机器人电力智能巡检新方案,面向危险、紧急和重复性任务设计系列解决方案,为电力系统建设与运维提供高效保障。
Starship Technologies 联合创始人兼 CEO Ahti Heinla 做客 Robot Talk 第158期,谈其 AI 配送机器人在街道和人行道上完全自主运行。Starship 已用超过 2700 台机器人完成逾 1000 万次自主配送,全程无需人工干预。
Qwen 团队发布通用视觉-语言-动作模型 Qwen-VLA,基于 Qwen 多模态骨干模型,将机器人操作与视觉语言导航统一为同一动作或轨迹预测问题,经 T2A、CPT、SFT、RL 四阶段训练产出 Qwen-VLA-Instruct。
推荐理由:Qwen-VLA 把操作与导航统一进一个策略模型,并给出四阶段训练流程与多基准对比数据,可据此判断通用 VLA 与专项模型的差距。
MIT 工程师与 Meta Reality Labs 等合作者在 Nature Communications 发表研究,开发出一种柔性凝胶,光照后可将其导电性提升 400 倍,所用光离子发生器(PIG)材料本身导电性可提升约 1000 倍。
康奈尔大学研究团队用可拉伸光纤传感器制作软体机器人夹爪,通过触觉预测草莓成熟度,并轻柔地将果实从藤蔓上旋拧摘下而不造成损伤。夹爪装有两种光纤传感器,分别测量手指弯曲度和指尖压力,据此估计物体形状并调整抓握力度;腕部还加入行星齿轮机构,使夹爪旋转拧下果实而非拉扯。