MuJoCo 3.14.0 发布:新增无穿透柔性接触模式与归档资源提供器
MuJoCo 3.14.0 新增实验性接触模式 ipc 标志,用离散积分器实现无穿透柔性接触,每步求解带线性化接触约束的增量势能,位置更新经连续碰撞检测验证,目前仅支持 dim-2 flex 且接触无摩擦。
MuJoCo 3.14.0 新增实验性接触模式 ipc 标志,用离散积分器实现无穿透柔性接触,每步求解带线性化接触约束的增量势能,位置更新经连续碰撞检测验证,目前仅支持 dim-2 flex 且接触无摩擦。
Hello Robot CEO 兼联合创始人 Aaron Edsinger 将在 TechCrunch Disrupt 2026 的 Real World AI Stage 现场演示家用辅助机器人 Stretch 4。Stretch 4 于 5 月发布,首轮量产已售罄,采用轮式底盘加单条伸缩臂,面向人类空间执行抓取和操作任务。使用该技术的重度行动障碍用户可自行进食、关百叶窗和挠痒。
意大利技术研究院机器人学副主任 Barbara Mazzolai 在 Nature Machine Intelligence 7 月发表的宣言中提出“可持续机器人”研究方向,主张把可持续性作为机器人设计的核心,减少技术对自然的足迹。她此前受章鱼、植物根系和种子启发开发了多款仿生软体机器人,并长期推动将物理与化学传感器集成到机器人中以感知所处环境。
NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,新增对 ROS Lyrical 和 Ubuntu 24.04 的支持,并引入面向 AI agent 的 setup、manipulation 等可复用技能与 agent-ready 文档。
推荐理由:Isaac ROS 5.0 的 agentic 工作流与 ROS Lyrical、Ubuntu 24.04 支持,为开发者提供了从开发到 Jetson 部署的完整路径参考。
NVIDIA 介绍如何借助 AI Agent 与 Isaac ROS 加速 ROS 2 节点。仅靠快速 CUDA 内核并不能保证 ROS 2 图高效,消息在节点间传递时仍可能经 CPU 内存序列化或拷贝,抵消感知与 AI 负载留在 GPU 上的收益。文中提到 NVIDIA 近期推出的上游抽象与 CUDA buffer 后端。
小米发布MiMo-V2.6-Pro和Flash,Pro为1.02万亿参数、420亿激活,在Artificial Analysis Intelligence Index上拿到46分,位列开源第一。
推荐理由:原文披露了MiMo-V2.6的RL训练成本、评测成绩与开源清单,读者可据此了解大规模强化学习训练的工程细节。
开发者对机器人行为树执行守卫 QERRA-v2 Classical 开展 20 例对抗基准测试,在 Webots 仿真中用 PAL Robotics TIAGo 验证。
一个研究原型打通了医学 CT 影像与 ROS 2 可视化及机器人仿真:从 DICOM/NIfTI CT 扫描出发,用 TotalSegmentator 分割左右肾及邻近器官,以高 HU 阈值加连通域提取结石候选,生成毫米级 3D 网格,再规划并排序 PCNL 经皮肾镜取石通道,在 RViz 和 Gazebo 中用带穿刺针的 Franka FR3 复现所选路径。
多名用户在 ROS Discourse 反映,访问 ROS 文档(如 C++ API)和 ROSCon 网站时频繁遇到 Anubis 拦截提示,提示称浏览器 Cookie 被阻止,但用户确认 Cookie 已启用、未使用 VPN,且添加域名白名单后仍无法解决。有用户表示该问题已持续约一个月,在手机数据与 WiFi、笔记本家庭与工作网络、最新版 Linux Chrome 上均出现。
NVIDIA 推出 Halos,称其为首个也是唯一一个面向物理 AI 的全栈安全系统,覆盖设计、验证与部署各层。
理想在 Hugging Face 发布 ME-U0 预训练权重,用于下游机器人策略后训练,采用 Apache 2.0 许可。页面给出 hf download 命令与 ME_U0_PRETRAINED_PTH 环境变量设置,并指向后训练说明;RoboDojo 评测需使用 ME-U0-RoboDojo。
推荐理由:读者可据此了解 ME-U0 预训练权重的下载方式、下游策略后训练用途与 Apache 2.0 许可。
NASA 好奇号项目科学家 Ashwin R. Vasavada 描述了 JPL 火星车运行中心的一次轮班:团队在 8:15 开始的三个小时内检查火星车健康状态、分析新传回的图像与测量数据并确定下一步活动,再用四小时把计划转成指令。好奇号自 2012 年着陆以来已重复这一流程上千次,目前在盖尔撞击坑 Aeolis Mons 高处发现多边形裂纹等古代水活动迹象。
第三方公益机构 Robocurve 发布机器人安全基准 RoboHarm,把 GPT-6 Astra、Fable 5.1 和 MolmoAct2 接入同一套双机械臂,测试刺向类人目标、加热压缩气体、制造有毒烟雾等五类物理风险任务,每任务每模型重复 20 次并由人工打分。
清华大学、无问芯穹、正行创新联合开源具身智能体基础设施 RPent,将通用大模型的任务规划、VLA 等专家模型的动作执行与记忆系统连接成闭环,在 LIBERO-PRO 基准达到 92.6% 任务成功率。
推荐理由:RPent 把大模型规划、VLA 执行与记忆机制串成闭环,并给出 LIBERO-Pro 成功率与 Flash Mode 延时数据,可据此判断分层智能体路线的工程取舍。
社区独立项目 CPM-jev 发布 v0.1-research-preview,这是基于 openbmb/MiniCPM5-2B-Base 的 LoRA 微调模型,新增决策头为候选动作打分并归一化为概率分布。
Hugging Face Hub 上线 K-vr/cube_stack3_Pi05_abs_batch8,这是基于 Physical Intelligence 的 π₀.₅ 视觉语言动作模型、用 LeRobot 0.6.1 微调并推送的机器人策略,基座为 lerobot/pi05_base。
DeformSmith 是一个从文本或单张图像自动生成可交互、物理可信可形变资产的框架,通过分层智能体构建与共享物理约束工具,逐步构建、测试并细化几何、物理模型、材质行为和机器人交互,直至资产可用于仿真与操作。
论文提出 Movement Trend Guidance,让 3D 扩散策略从短观测历史中学习交互演化的紧凑隐表示,训练时用稀疏未来夹爪状态监督,推理时仅保留该隐表示作为未来导向条件。
推荐理由:论文提出 Movement Trend Guidance,用隐变量为 3D 扩散策略提供交互走向的前瞻信息,并给出多基准对比数据。
Qyvos 是基于 SupersonicLabs/Julia-1 仅微调决策头得到的决策/分类模型,在 ZefanCai/Open-Jev 数据集上训练,支持 choice、score、noul 三类决策。模型冻结 ModernBERT-small 编码器与动作头,仅训练 3,699,073 个参数(占 2.56%),在 3.9 GB 内存约束下完成 3,750 步训练。
云南大学张文华团队研制出钙钛矿太阳能电池,在模拟水下10米光谱条件下光电转换效率达34.71%,陆地条件下为17.08%。他们将电池封装后集成到水下迷你机器人上,在南海涠洲岛附近测试,10米深处115平方厘米电池两小时发电324毫瓦时,2米处为1416毫瓦时。研究估算电池在25°C水温下可连续运行约5.5年。
ETH Zurich 研究人员把一只商用机器人手改造成能用手指行走的装置,为其加装电池和 Raspberry Pi Zero 2 W,并开发神经网络控制软件。该手有 20 个关节、每指 4 个,网络根据先前动作、手部状态和当前目标迭代输出下一关节状态;训练先在仿真模型中进行强化学习,行走速度快于改造的四足运动模型。
PhAI Labs 联合牛津、斯坦福、普林斯顿、港中文等团队发布技术报告 JEPA-Anything,提出面向不同领域学习预测模型的跨领域框架,各领域保留自己的观测形式与编码器,共享预测核心和统一的 latent world-state interface。
原名为 UP.Labs 的创业公司孵化机构更名为 Vantora,获 Silversmith Capital Partners 1 亿美元首笔外部投资,并全面转向物理 AI。
IEEE Spectrum 的 Video Friday 本周收录了 CLIMB Lab 的演示:四旋翼本质上就是两个彼此深爱的双旋翼。
百度智能云已为超过50家重点具身企业提供全栈AI云技术支撑,其百舸平台将SONIC模型训练配方集成上云后可一键扩展至128卡训练规模,WAM模型推理延迟降至优化前的四分之一。在东莞,由百度智能云承建运营的具身智能训练场规划13个真实产业场景、配置50台套异构本体,已服务35家具身智能企业。IDC报告显示百度智能云以29.55%市场份额位居中国具身智能云市场第一。
EPFL 的 Aude Billard 与 Mirko Kovač 等研究者提出新学科 Sustainability Robotics,主张机器人不应只按技术性能评估,还须纳入环境、社会与经济影响,并遵循最小侵入、普遍可及、共生三条原则。
针对 MiniMax-H3 这类全模态生成模型,一项新评测考察其物理世界推理能力,在 517 个评测实例中整体成功率为 41.97%。其中基于视频的决策推理成功率最高,为 56.00%,基于音频的消歧推理最弱,仅 27.40%。评测设计了隐式提示配多帧、音频-图像、前缀视频和音视频四类任务,要求模型跨模态整合互补信息以推断潜在事件状态与未来动态。
Hugging Face 论文页发布 FAMOS,一个从稀疏无序部分点云预测可动部件分割与关节参数的前馈模型,支持包括单视图在内的可变数量输入。它提出 Multi-state Articulation Transformer,以交替的状态级与全局注意力聚合多观测关节线索,并引入观测关节跨度目标监督各部件在输入观测中的运动范围。
亚马逊旗下 Zoox 在 Nevada 的 100 辆 robotaxi 运营上限将于 9 月 25 日到期,为其在拉斯维加斯扩大商业车队扫清障碍。Zoox 目前约 100 辆无方向盘、无踏板的定制 robotaxi 分布在美国四城,仅拉斯维加斯收费运营,NHTSA 豁免允许其两年内每年部署最多 2500 辆。
新西兰怀卡托大学团队公布一款用光学和红外传感单元替代电极的假肢臂环,光电探测器贴近皮肤覆盖不同肌肉群,并采用新型收紧机构以减少运动伪影。团队称皮肤色调会影响传感器读数,正迭代设计并计划开发电学与光学传感混合的假肢。
Lucid Motors 与欧洲出行平台 Bolt 达成合作,Bolt 计划部署至少 25,000 辆基于 Lucid 中型电动车平台打造的全自动驾驶车辆,并将拥有和运营该车队。双方将从产品开发阶段就共同打造支持自动驾驶系统(ADS)的车辆平台,车辆采用英伟达 Hyperion 计算与感知架构,但未公布自动驾驶软件供应商。目前双方未发生资金往来,Bolt 也未下单,且无公开部署时间表。
Isaac Lab 3.0 Early Access 发布,引入工厂式多后端架构,物理、渲染与可视化可分别选择 isaacsim_physx、ovphysx、newton_mjwarp 等配置,并支持不安装 Isaac Sim 的无 Kit 工作流。
推荐理由:Isaac Lab 3.0 早期访问版把物理、渲染与可视化拆成可切换后端,并给出 2.x 到 3.0 的迁移清单,便于评估现有训练流程的改动量。
MoveIt 2 发布 2.15.2 版本,由 nbbrooks 于 9 月 16 日打标签。该版本在 GitHub 上提供 2 个资源文件下载,仓库现有 2k 星标、810 次 fork。
研究显示,针对视觉语言动作(VLA)模型的后门攻击 BadVLA 可在触发器出现时让机器人动作轨迹产生条件性偏移,无触发器时任务表现基本正常;GoBA 用咖啡杯等普通物体作触发器,报告 97% 攻击成功率且不降低干净输入上的表现。
英伟达 Inception 全球物理 AI 负责人 Les Karpas 将在 TechCrunch Disrupt 2026 的 Real World AI Stage 发表演讲,主题为机器人为何仍在等待自己的 ChatGPT 时刻、障碍何在。
紫东太初开源通用多模态大模型 ZDTaichu5.0-9B,在九项空间理解基准测试中八项位列 10B 档位第一,MindCube-tiny 得分 78.27,对照的 Gemma4 8B-E4B、Gemini 3 Pro、Grok 4 分别为 48.8462、70.87 和 63.56。
IEEE 已公开 2026 年 ICRA 的主旨演讲、全体会议、行业主题演讲、奖项演讲、教程及六场专题讨论的视频录像。本届 ICRA 于 6 月 1 日至 5 日在维也纳举行,全体演讲嘉宾包括 Ken Goldberg、Barbara Mazzolai 和 Roland Siegwart。
西门子数控(南京)生产基地引入银河通用人形机器人试工,在表面贴装产线搬运印刷电路板,该产线每月搬运总重量达18万公斤。西门子Xcelerator平台已聚集600多家生态伙伴、900多个解决方案和超66万注册用户,连接机器人厂商与真实工业场景。华沿机器人等伙伴借助平台上的工易魔方,以数字孪生和可视化拖拽完成产线场景构建与虚拟调试。
Nav2 发布 1.5.2 版本,对应 Lyrical Sync 1,时间为 2026 年 9 月 15 日。
Agility Robotics 发布人形机器人 Digit 5,可举起 23 公斤至 2.1 米高度,每天可运行超过 20 小时,并能在人员靠近时自主放下负载、停止或坐下,从而无需物理隔离即可与人近距离作业。