AMD AI DevMaster 黑客松设 Physical AI 赛道,面向 ROS 开发者开放报名
AMD AI DevMaster 黑客松开设 Physical AI 赛道,面向全球开发者征集基于 AMD Radeon GPU 和 ROCm 的机器人与具身智能方案,可涉及机器人操作、人形机器人、四足行走、自主导航、仿真及具身智能研究,并可使用 Genesis、MuJoCo 等仿真环境。
AMD AI DevMaster 黑客松开设 Physical AI 赛道,面向全球开发者征集基于 AMD Radeon GPU 和 ROCm 的机器人与具身智能方案,可涉及机器人操作、人形机器人、四足行走、自主导航、仿真及具身智能研究,并可使用 Genesis、MuJoCo 等仿真环境。
EPFL 与 MIT 工程师受潜水鸟类启发,设计出重量不足 300 克的扑翼式水空两栖飞行器 FAAV,可在水下游泳并拍翅跃出水面继续飞行,相关成果发表于 Science。
LinkForge 在 Blender Extensions 平台下载量突破 5000,作者借此提出为机器人描述引入可编程中间表示(IR)的构想。该 IR 可编程组合机器人模型、在导出前校验运动学与物理属性,并编译为 URDF、XACRO 等格式。其目标并非取代 URDF 或 ROS,而是在现有 ROS 工作流之前提供工具无关的编写与校验层。
阿里巴巴旗下高德发布通用世界模型工坊ABot-World Studio并开放测试,可将文字或图片生成可实时交互的AI世界,输出为视频与3DGS文件。该工坊可在单张5090上本地部署,官方实测单次连续推理稳定运行超1小时且无质量衰减,并内置“时空任意门”实现3D世界间跃迁。底层ABot-World0与ABot-3DWorld0模型已全面开源,官网、GitHub及Hugging Face同步上线。
推荐理由:高德把交互式视频与3DGS场景生成统一进一个工坊,并开源模型,读者可据此了解世界模型的一条新路径。
Gazebo PMC 于 2026-07-13 召开周会,构建农场现有优先问题已全部解决,仅剩 CMake 4.4 反斜杠处理相关的 CMP0219 策略警告,已提交临时修复 PR。
OpenAMRobot v0.0.1 发布,这是一个采用 MIT 许可、基于 ROS 2 Jazzy 构建的开源移动机器人平台,面向教育、研究、实验和快速原型开发。当前版本包含自主导航、SLAM 与建图、仿真支持、自主对接、基于网页的操作界面,以及通过 ROS 2 操作该机器人的工具和示例。作者在 ROS 社区征集关于系统与包架构、安装与文档、开发者体验及后续路线图的反馈,并欢迎贡献和问题建议。
OpenAMRobot v0.0.1 发布,这是该开源移动机器人平台的首个产品级版本,基于 ROS 2 Jazzy,面向机器人研究、教育、快速原型和早期具身智能开发。
开发者发布 QERRA-HSR v0.1,一个在 Webots R2025a 中与 TIAGo 人形机器人标准控制器并行运行的轻量确定性安全评估循环,按危险接近度和人类不适向量执行 CLEAR、MONITOR、CRITICAL 三态边界控制。
Genesis 发布 v1.2.2,新增面向强化学习灵巧策略训练的高吞吐真实触觉传感器系列,并支持迟滞、失效触觉单元、探针增益等噪声选项。非凸碰撞检测鲁棒性提升,性能与凸分解相当,修复了虚假深层接触与薄壳穿透问题;启用 noslip 后处理对所有后端的减速降至 20% 以内。
OpenCat 机器狗现可在浏览器中免费模拟运行,代码基于 Web IDE,主文件简洁,核心逻辑位于 src/moduleManager.h 的 read_serial 和 src/reaction.h 的 reaction 中。用户可通过模拟器按钮或串口命令(如 ksit 让狗坐下)控制,支持修改代码并编译后在虚拟机器人上运行。该机器人支持加装简单传感器或更换头部为机械臂,但传感器配置有限。
ROS 官方发布 7 月 6 日当周周报,提醒 7 月 12 日是 ROSCon Global 早鸟票最后购买日。本周推荐了可用免费卫星影像和 DEM 数据生成仿真世界的 Gazebo 工具链、支持发送指令且可 pip 安装的机器人数据可视化界面 RUBI,以及支持时序、2D/3D/4D 数据并可通过 AppImage 安装的 PlotJuggler v4.0。
机器人/UAV 工程师 Rahul 发布 12 个免费浏览器端工具,覆盖 URDF 校验与查看、Xacro/URDF/MJCF/SDF/STEP/DH 格式转换、网格惯量计算、旋转转换、ArduPilot 参数对比及 SBOM 与 EU CRA 合规检查,全部在客户端 WASM/JS 运行,文件不上传。
SW2GZ 是一个 SolidWorks 插件,可将装配体直接导出为可启动的 ROS 2 包或 Gazebo(Gz Sim)模型/世界,无需手写 URDF。它从 SolidWorks 模型读取质量、惯量、关节坐标系和配合,提供 Robot、World、Asset 三种导出模式,关节类型由配合推导。
Gazebo 社区 7 月会议将聚焦喷涂仿真,由 A.T.O.M Robotics Lab 的 Arjun K Haridas 介绍一个在 Gazebo 中模拟真实喷涂的插件,动机来自真实工业喷涂自动化项目,因 Gazebo 缺少喷涂/粉末涂装仿真方案。
OpenRAL 发布开源机器人智能层(RAL),定位为物理 AI 的运行时框架,在 ROS 2、tf2、MoveIt 2、Nav2、ros2_control 之上用 Pydantic v2 schema 建立各层之间的类型化契约。
论文提出 RynnWorld-Teleop,一种动作条件世界模型,用生成式世界模型替代实体机器人实现数字遥操作,将操作者手部姿态流转化为机器人视角的高保真视频,并作为与本体无关的动作标签经重定向迁移到任意目标机器人。
推荐理由:论文提出用生成式世界模型替代实体机器人采集数据,读者可了解数字遥操作如何解耦硬件约束并生成可迁移轨迹。
高德7月8日发布Phys AI Data数据系统,称其为业内首个面向物理AI训练与应用的一站式空间数据基座,由面向仿真训练的Phys AI Foundry和面向实际应用的Phys AI Map组成。
Image2Sim 是一个实时神经仿真框架,可从带位姿的 RGB-D 图像序列构建可交互的具身导航环境。相关代码与具体使用说明已在 GitHub 页面发布。作者感谢 Gim Hee Lee 教授的指导,以及阿里巴巴、香港科技大学的 Yinghao Xu 教授提供的 64 张 H20 GPU 支持。
推荐理由:Image2Sim 用带位姿的 RGB-D 序列生成可交互导航环境,读者可了解神经仿真如何降低具身导航的数据门槛。
GaP 是一种图即策略(Graph-as-Policy)多智能体编码框架,从模块化开放机器人技能库(MORSL)生成含感知、规划和控制节点的有向计算图,并构建内部仿真环境并行演练不同图以迭代优化结构与参数,提升成功率和吞吐量。
推荐理由:论文提出用多智能体编码生成计算图并并行仿真迭代,为变异性自动化任务提供可复用的可靠性思路。
论文提出 SVA(Search, Value, and Act)框架,将动作生成与后果评估解耦,为冻结的 VLA 策略引入长期后果感知。SVA 先用蒙特卡洛树搜索在仿真中探索 VLA 输出分布并收集带经验回报的轨迹,再蒸馏为轻量 Q 值模型,部署时由冻结 VLA 提出多个候选、评估器选出不确定性正则化后 Q 值最高的动作,无需仿真器。
推荐理由:论文提出冻结 VLA 的动作评估框架,用树搜索蒸馏 Q 值模型,读者可了解测试时扩展的替代思路。
Gazebo PMC 在 2026-07-06 的会议上同意设立每月约两次、跨时区轮换的维护小时,供维护者通过分组会议协作审查 PR。会议讨论了 SDFormat 新的命名空间占位符语法(__name__、$name、{name} 等),最终选择推迟,并倾向不回溯到 Fortress 而面向 Harmonic。
针对 CAD、URDF 导出器和切片软件把 3D 打印件当作实心塑料块计算惯量、导致 MuJoCo/PyBullet/Gazebo 仿真动力学失真、拉大仿真到真实迁移差距的问题,开发者用 LeRobot SO101 机械臂测试后开源了 printphys 工具。
机械工程毕业生 Hatim Ahmed Hassan 展示了个人项目 Beam AgroBot V2,一个完全基于 ROS 2 Humble 的自主农业机器人仿真平台。
WAIC 2026 将聚焦世界模型路线之争,围绕 VLA 与世界模型的替代、并存、融合三种猜想展开讨论。论坛汇聚大晓机器人王晓刚、诺奖得主托马斯·萨金特及英伟达等代表,萨金特以开普勒式描述模型与牛顿式结构模型为行业路线定调。
英伟达 GEAR 联合李飞飞团队、佐治亚理工大学等机构发布 Real2Sim 系统 SimFoundry,只需一段真实世界 RGB 视频即可自动生成可交互、可训练、可评测的机器人仿真环境。
推荐理由:英伟达 GEAR 与李飞飞团队等提出 Real2Sim 系统,用一段视频自动扩展仿真训练数据,读者可了解其闭环思路与实验结论。
Genesis 发布 v1.2.1,通过更好利用稀疏性和增量 Hessian 更新,大幅提升 CPU 大场景扩展能力,100 实体/1000 几何体的场景现可以 120FPS 实时运行。该版本新增 JointTorqueSensor,并修复复合连杆质心对齐、多材质 GLB 网格纹理加载及非凸网格水密化算法等问题。
Genesis 发布 v1.1.1,主要提升凸与非凸几何体刚体碰撞检测的鲁棒性,关闭凸分解以获得更高保真度不再被视为实验性功能。该版本修复了 GPU 仿真非确定性问题、凹几何体非凸碰撞检测,并改进基于扰动的多接触凸-凸碰撞检测。此外还去重 GLB 共享材质纹理、跳过彩色分割图灰度转换,并支持向 RigidSolver.set_base_links_ 传入切片环境掩码。
地瓜机器人发布世界模型 Uranus,定位为机器人开发基础设施,用于评测 VLA 与世界模型并支持操作训练仿真。它采用帧级闭环逐帧生成,训练时只见过 2 秒短片段,推理时可稳定运行 60 秒,支持 G1 人形机器人和 Franka 协作臂,目前仅支持 manipulation 训练,尚不支持 locomotion。
阿德莱德 Robotics and Computer Science Academy(ARCSA)面向成人推出线下 Professional Robotics with ROS 2 课程,采用 The Construct 课程体系与 BotBox Robotics Lab,学员可同时接触仿真和实体机器人。
NVIDIA 发布 Isaac Lab v3.0.0-beta2.patch1,在 Isaac Lab 3.0.0 Beta 2 基础上更新支持 Isaac Sim 6.0.1,包含针对 NuRec 工作流的修复与改进。
kc_vision 是一个完全开源的自主地面机器人项目,仿真栈可在 Ubuntu 24.04 上开箱运行,无需硬件。它用 SLAM Toolbox 或 Google Cartographer 建图,通过 Nav2 在 RViz 中自主导航并避障,还能跟随 GPS 航点并在无地图情况下用牛耕式覆盖规划器清扫户外区域,行距 0.2 m 可配置。
有开发者查阅 SDF 规范 v1.12 发现 World 下存在 audio 属性,但 Gazebo API 中 sdf::World 仅能设置 AudioDevice 字符串且不会生成对应元素,遂询问 Gazebo 的音频能力及用法。随后有回复称相关插件已发布。
群核科技三篇论文入选 ECCV 2026,涵盖空间感知与推理、强化学习数据生成、高保真物理仿真。其中联合 Adobe、NVIDIA、Apple、Intel 等提出的 SPEAR 仿真平台开放超 14000 个原生 Python 接口,可输出深度图、表面法线、实例分割等物理属性数据,并接入 InteriorAgent、InteriorGS 等结构化三维数据集。
NVIDIA 介绍基于 OpenUSD 和 Omniverse 的三种视觉 AI 智能体工作流:用 Defect Image Generation 技能生成合成缺陷数据、用 Video Data Augmentation 扩展场景覆盖、用 TAO 技能微调模型。
Open Robotics 的 gz-sim 发布 8.14.0 版本,由 azeey 打上 gz-sim8_8.14.0 标签,提交 4ada862 已通过 GitHub 签名验证。该提交标题为“Prepare for 8.14.0”,随附 2 个资源文件。
Isaac Lab 3.0 Beta 2 发布,作为 3.0 beta 的稳定化版本,兼容 Isaac Sim 6.0.0,扩展了 Newton 支持(VBD、求解器耦合、Kamino、崎岖地形、传感器)与多后端物理,并简化训练和安装命令。
推荐理由:Isaac Lab 3.0 Beta 2 汇总了多后端物理、Newton 与无 Kit 工作流的改动,可据此判断升级与迁移成本。
康奈尔大学工程师研发出 Cross-Link Collective 机器人集体,由数十个长约 200 毫米、宽约 20 毫米的模块组成,每个模块内置小电机在 I 形和 U 形之间振荡,两端有弱魔术贴可临时连接相邻模块,相关研究 5 月 20 日发表于 Science Robotics。
Open Robotics 为 Ignition Gazebo 6 打上 ignition-gazebo6_6.18.0 标签,提交由 Addisu Z. Taddese 签署,版本进入 6.18.0 准备阶段。
NVIDIA 与斗山集团扩大合作,覆盖斗山机器人、斗山山猫、斗山恒能和斗山电子材料 BG,将 NVIDIA 全栈加速计算平台与斗山工业自动化、发电和电子材料能力结合。
Open Robotics 发布 Gazebo 仿真器 gz-sim 10.4.0 版本,提交由 Arjo Chakravarty 签署,Steve Peters 参与协作。该版本为 gz-sim10 分支的 10.4.0 发布准备提交。