用确定性包装器加固 HRI 安全:基于 Webots 的 TIAGo 演示
开发者发布 QERRA-HSR v0.1,一个在 Webots R2025a 中与 TIAGo 人形机器人标准控制器并行运行的轻量确定性安全评估循环,按危险接近度和人类不适向量执行 CLEAR、MONITOR、CRITICAL 三态边界控制。
开发者发布 QERRA-HSR v0.1,一个在 Webots R2025a 中与 TIAGo 人形机器人标准控制器并行运行的轻量确定性安全评估循环,按危险接近度和人类不适向量执行 CLEAR、MONITOR、CRITICAL 三态边界控制。
Genesis 发布 v1.2.2,新增面向强化学习灵巧策略训练的高吞吐真实触觉传感器系列,并支持迟滞、失效触觉单元、探针增益等噪声选项。非凸碰撞检测鲁棒性提升,性能与凸分解相当,修复了虚假深层接触与薄壳穿透问题;启用 noslip 后处理对所有后端的减速降至 20% 以内。
OpenCat 机器狗现可在浏览器中免费模拟运行,代码基于 Web IDE,主文件简洁,核心逻辑位于 src/moduleManager.h 的 read_serial 和 src/reaction.h 的 reaction 中。用户可通过模拟器按钮或串口命令(如 ksit 让狗坐下)控制,支持修改代码并编译后在虚拟机器人上运行。该机器人支持加装简单传感器或更换头部为机械臂,但传感器配置有限。
ROS 官方发布 7 月 6 日当周周报,提醒 7 月 12 日是 ROSCon Global 早鸟票最后购买日。本周推荐了可用免费卫星影像和 DEM 数据生成仿真世界的 Gazebo 工具链、支持发送指令且可 pip 安装的机器人数据可视化界面 RUBI,以及支持时序、2D/3D/4D 数据并可通过 AppImage 安装的 PlotJuggler v4.0。
两支全尺寸人形机器人队伍首次在硬件上完成 11 对 11 足球比赛,RoboCup 称这是机器人领域长期愿景的一次落地。1X 发布为 NEO 平台打造的 25 自由度机器人手,采用腱驱动、触觉传感与内置柔顺,可实现灵巧操作与精细工具使用。
机器人/UAV 工程师 Rahul 发布 12 个免费浏览器端工具,覆盖 URDF 校验与查看、Xacro/URDF/MJCF/SDF/STEP/DH 格式转换、网格惯量计算、旋转转换、ArduPilot 参数对比及 SBOM 与 EU CRA 合规检查,全部在客户端 WASM/JS 运行,文件不上传。
开发者正在为 Windows 构建 ros2-godot 独立插件,希望内嵌所有 dll 而无需安装 ROS 环境。
SW2GZ 是一个 SolidWorks 插件,可将装配体直接导出为可启动的 ROS 2 包或 Gazebo(Gz Sim)模型/世界,无需手写 URDF。它从 SolidWorks 模型读取质量、惯量、关节坐标系和配合,提供 Robot、World、Asset 三种导出模式,关节类型由配合推导。
Gazebo 社区 7 月会议将聚焦喷涂仿真,由 A.T.O.M Robotics Lab 的 Arjun K Haridas 介绍一个在 Gazebo 中模拟真实喷涂的插件,动机来自真实工业喷涂自动化项目,因 Gazebo 缺少喷涂/粉末涂装仿真方案。
乌克兰RoverTech公司CEO Borys Drozhak称,其Zmiy无人地面车辆(UGV)平均能在杀伤区完成57次任务才被摧毁,而多数UGV仅能存活约7次。Zmiy重800公斤、尺寸2.15×1.5米,可配置为排雷、后勤、灭火、机枪射击或榴弹发射等型号。乌克兰总统泽连斯基已下令在2026年底前采购5万套UGV,是2025年采购量的三倍多。
Pika Sense 现支持 AgileX PiPER、PiPER-X、NERO 与 xArm Lite 6 四款机械臂,可结合 Pika Station、Pika Gripper 实现低时延末端执行器遥操作,覆盖单臂与双臂系统。
蚂蚁灵波发布 LingBot-VA 2.0,称其为全球首个具身原生预训练 VA 基座模型,从架构、数据到训练目标均为机器人定制。模型采用因果 DiT 加稀疏 MoE 主干,视频主干总参数约 13B、推理激活约 1.9B,训练参数量约 15.3B、每 token 推理激活约 2.5B。
推荐理由:蚂蚁灵波 LingBot-VA 2.0 从架构到训练目标均为机器人定制,读者可了解具身原生 VA 基座的设计取舍与实测数据。
7月10日,蚂蚁灵波发布业界首个具身原生世界动作模型LingBot-VA 2.0,基于自回归架构从头预训练,采用语义视觉-动作分词器、因果预训练、MoE架构和异步推理机制,实现单卡150Hz实时推理效率。
OpenRAL 发布开源机器人智能层(RAL),定位为物理 AI 的运行时框架,在 ROS 2、tf2、MoveIt 2、Nav2、ros2_control 之上用 Pydantic v2 schema 建立各层之间的类型化契约。
作者开源了命令行工具 robot-triage,可对 .bag 或 .mcap 文件自动标记传感器掉线、错误突发、位姿跳变、指令与实际偏差、数值冻结和超范围读数等问题。
AlayaWorld 是一个开源全栈框架,用于构建可实时交互的生成式世界,支持自由导航及战斗、施法、召唤怪物等多样动作。该框架统一了数据准备、模型架构、训练、推理加速与部署,并开源可复现管线、参考实现、评测工具与文档。论文称其基于游戏录像和真实视频训练,可捕捉多样视觉外观与物理动态,为游戏之外的具身智能等交互应用提供机会。
推荐理由:论文给出可复现的视频世界模型全栈框架,读者可了解其模块化架构与开源管线如何支撑实时交互生成。
论文提出 RynnWorld-Teleop,一种动作条件世界模型,用生成式世界模型替代实体机器人实现数字遥操作,将操作者手部姿态流转化为机器人视角的高保真视频,并作为与本体无关的动作标签经重定向迁移到任意目标机器人。
推荐理由:论文提出用生成式世界模型替代实体机器人采集数据,读者可了解数字遥操作如何解耦硬件约束并生成可迁移轨迹。
RynnWorld-4D 是一个多模态 4D 世界模型,可从单张 RGB-D 图像和语言指令出发,在统一扩散过程中同步生成未来的 RGB 帧、深度图和光流。其三分支架构结合跨模态注意力与逐帧 3D RoPE,并配套超过 2.544 亿帧的 Rynn4DDataset 1.0 数据集。
推荐理由:论文提出用同步 RGB、深度与光流构建 4D 世界模型,并给出策略头与大规模数据集,可供世界模型与操作研究者参考。
原力灵机在开发者大会上发布新一代具身基础模型DM0.5,参数规模4B较上一代DM0翻倍,数据量增加400%,由5万小时真机操作数据、10万小时第一视角数据和100万平方米场景重建数据构成。
蚂蚁灵波开源 LingBot-Video,称其为面向具身智能的大规模 MoE 视频基础模型,采用 30B 参数、推理时激活约 3B。模型引入超 70000 小时具身相关视频,覆盖机器人操作、导航与第一视角等场景,并加入物理合理性、任务完成度等多维奖励。团队称其在 RBench 上超过通用视频生成标杆模型,并已在 TI2V 任务的开源竞品中达到 SOTA。
7月9日,蚂蚁灵波科技开源新一代实时交互世界模型LingBot-World 2.0(又称LingBot-World-Infinity),支持小时级实时生成、720p/60fps高清实时输出,并首次将Agent机制引入世界模型。
7月9日,蚂蚁灵波开源LingBot-Video,称其为全球首个基于MoE架构、面向具身智能的开源视频生成基础模型。该模型采用DiT+MoE设计,30B总参数生成时仅激活约3B参数,相比同等规模Dense架构约有3倍推理效率,并引入VLA、VLN、Ego等共7万小时具身数据。
量化派近期在餐饮后厨完成四轮具身智能技术验证,覆盖三明治柔性制作、购物袋自主分拣、牛排跨抽屉找盐调味和奶茶跨设备协同,均落地真实动态工况。其定位为跨场景、跨本体的开放生活场景世界模型提供商,不绑定硬件,主张让机器人从「动作自动化」迈向「任务级自主作业」,并以RaaS按效用付费模式切入。
General Intuition 上月以 23 亿美元估值融资 3.2 亿美元,其 CEO Pim de Witte 认为具身 AI 会像大语言模型一样走向通用基础模型,而非为每个本体和环境单独采集海量真实数据。
Hugging Face 的 LeRobot 发布 v0.6.0,带来多项破坏性变更:pip install lerobot 不再包含数据集与训练依赖,需按需安装如 lerobot[training]。
推荐理由:LeRobot v0.6.0 的破坏性变更清单和新增基准、策略,能帮现有用户判断升级成本与可迁移能力。
魔芯科技联合浙江大学潘云鹤院士、华为等发布实时交互世界模型 MoWorld,全栈基于国产 NPU,14B 参数 MoE 模型实现最高 50FPS 推理,推理成本为同规模 GPU 方案的 30%。
曾推出 RoboTwin 系列的团队发布 RoboDojo,一个统一的仿真加真实世界机器人操作评测基准,包含 42 个仿真任务和 18 个真机任务,覆盖泛化、记忆、精细操作、长程执行和开放语义五类能力。
2026世界机器人大会将于8月19日至23日在北京经济技术开发区举行,主题为“人机共生,产需共融”。博览会参展企业300余家、较去年增加36%,预计展品超2000件、首发新品150余件,同期活动60余场。大会将发起“全球机器人应用探索计划”,国务院国资委将现场宣布成立中央企业机器人创新联合体。
智源研究院悟界·RoboBrain Orca Team发布技术报告Orca: The World is in Your Mind,提出Next-State Prediction路线,先学习统一的世界状态表征,再从中读出理解、预测与行动能力。
高德7月8日发布Phys AI Data数据系统,称其为业内首个面向物理AI训练与应用的一站式空间数据基座,由面向仿真训练的Phys AI Foundry和面向实际应用的Phys AI Map组成。
2026世界人工智能大会暨人工智能全球治理高级别会议将于7月17日至20日在上海世博、张江、西岸"三地四馆"举行,主题为"智能伙伴 共创未来",并首发主题片。大会策划140余场论坛,展览总面积首次突破10万平方米,1100余家企业参展,超300款产品将全球首发。上海2025年规上人工智能企业394家,产业规模超6370亿元,同比增长39.5%。
RoboCup 2026 于 7 月 2-6 日在韩国仁川举行,吸引来自 40 个国家近 3000 名参与者,赛事包含竞赛、培训与研讨会。清华大学队于周日成功卫冕人形联赛冠军,Hamburg Bit-Bots 等 4 支 Mini Pi plus 队伍进入八强。参赛者还为 Booster T1 加装外部激光雷达和背包,以实现室内精准定位与导航。
Rank-Then-Act(RTA)提出一种无需手工奖励函数的强化学习控制方法,通过训练视觉语言模型从打乱顺序的视频帧中识别任务进度,并将该进度信号作为强化学习的唯一奖励。该方法不依赖人工设计奖励函数,也不使用稀疏环境信号。
蚂蚁灵波发布并开源通用 VLA 模型 LingBot-VLA 2.0,预训练数据达 6 万小时,其中 5 万小时来自覆盖 20 种机器人构型的真机轨迹数据,1 万小时来自第一视角人类操作视频。
推荐理由:蚂蚁灵波开源 LingBot-VLA 2.0,读者可了解其 6 万小时数据规模、20 种本体覆盖及 GM-100 对比结果。
蚂蚁灵波科技7月8日宣布升级并开源具身基座模型LingBot-VLA 2.0,预训练融入6万小时真实物理数据,覆盖17个机器人品牌的20种构型,并扩展对头部、腰部、末端执行器及移动底盘等自由度的支持。
推荐理由:原文给出预训练数据规模、支持构型与双臂及移动操作评测对比,可据此判断跨构型VLA基座的落地进展。
至简动力宣布首款全场景机器人i7 Pro完成首批百台交付,用时不到一年,并同步亮相与绿的谐波子公司开璇智能合作的全球首个CNC智能化具身机器人产线。i7 Pro在产线上加工谐波减速器内部零件,顶配版本售价22.98万元,公司称购买后可1.5年回本。创始团队王凯、贾鹏、王佳佳均来自理想汽车智能驾驶团队,公司称已搭建LaST₀基座模型及完整数据闭环,下月还将发布两款新品。
LingBot-VLA 2.0 在 LingBot-VLA 基础上从三方面改进:重构数据处理流程并预训练约 6 万小时数据,含 5 万小时覆盖 20 种机器人构型的轨迹和 1 万小时第一人称人类视频;动作空间扩展到头部、腰部、移动底盘和灵巧手的自由度;引入视频表示模型与深度估计模型做未来预测的代理任务以增强时序推理。
推荐理由:论文给出 LingBot-VLA 2.0 在数据规模、动作空间与预测建模三方面的改动,可了解 VLA 落地差距的一种应对思路。
Image2Sim 是一个实时神经仿真框架,可从带位姿的 RGB-D 图像序列构建可交互的具身导航环境。相关代码与具体使用说明已在 GitHub 页面发布。作者感谢 Gim Hee Lee 教授的指导,以及阿里巴巴、香港科技大学的 Yinghao Xu 教授提供的 64 张 H20 GPU 支持。
推荐理由:Image2Sim 用带位姿的 RGB-D 序列生成可交互导航环境,读者可了解神经仿真如何降低具身导航的数据门槛。
PointDiT 是一种基于普通 ViT 的极简像素空间扩散 Transformer,直接处理原始 3D 点图块,并以预训练 DINOv3 的图像 token 为条件,扩散主干完全从零训练,无需点图 tokenizer。它在单图 3D 重建上超越了复杂的潜空间扩散模型,同时比混合架构更简单,几何结构更锐利,在透明物体等高度歧义区域更稳健。
福田敏男获 2026 年 IEEE Richard M. Emberson 奖,表彰其在机器人领域的杰出服务。他发表超 2000 篇论文,1985 年提出模块化细胞机器人系统 CEBOT,并创办 IEEE/RSJ IROS 会议,2020 年成为首位亚裔 IEEE 主席。