MineAmongUs:VLM 智能体在具身社交互动中的言语与非言语欺骗
Hugging Face 论文提出 MineAmongUs——一个 3D 多模态 Among Us 沙盒,内鬼智能体需通过言语与非言语动作联合欺骗船员,并配套可配置的 VLM 智能体框架 ARIA,暴露五个认知组件消融轴。实验显示 VLM 智能体依靠言语与非言语联合欺骗取胜,非言语通道在框架消融和跨 VLM 评估中都是更关键的获胜因素。
Hugging Face 论文提出 MineAmongUs——一个 3D 多模态 Among Us 沙盒,内鬼智能体需通过言语与非言语动作联合欺骗船员,并配套可配置的 VLM 智能体框架 ARIA,暴露五个认知组件消融轴。实验显示 VLM 智能体依靠言语与非言语联合欺骗取胜,非言语通道在框架消融和跨 VLM 评估中都是更关键的获胜因素。
南加州大学教授 Jernej Barbič 因设计开发 Ziva VFX 获得 2025 年奥斯卡技术成就奖,该软件可模拟 3D 数字人与生物的肌肉、脂肪和皮肤。Ziva VFX 由他参与创办的 Ziva Dynamics 于 2016 年推出,2021 年被 Unity Technologies 收购,已用于《海王与失落的王国》《哥斯拉大战金刚:新帝国》《毒液2》等 60 多部电影。
Hugging Face 论文页上线 Magpie,一个面向交互式游戏的实时世界渲染器。该页面目前仅开放论文讨论,未披露模型规模、渲染帧率或真机部署等细节。
NVIDIA 介绍用 AI 智能体训练跨本体机器人导航策略的方法。导航需持续定位、理解环境、选路并避障,与仅产生稳定运动的行走不同;迁移到新机器人或新场景通常需要新数据、仿真资产和机器人接口。
EPFL 的 MICROBS 实验室利用亥姆霍兹共振原理,造出靠声波产生定向推力的空心腔体结构,成果发表于 Science Advances。厘米级微型船最多装三个腔体,各调谐到不同可听频率,切换频率即可选择激活腔体来转向、避障乃至自主导航。
智象未来在 WRC 2026 发布原生全模态交互式世界模型 HiDream-O1-World,基于自研 UiT 架构,首次参评即登顶 WBench 的 Navi 分榜。该模型支持文本、图像及交互式操控输入,具备漫游、编辑、交互三项能力,核心突破是长时程时空一致性与物理一致性。
知跃空间智能发布全脑仿真基础平台 DeepSoma(知跃灵物),从树突、膜电位、离子通道等生物物理层面建模精细神经元,而非 Eon Systems 采用的 LIF 简化模型。
硅羽科技创始人张富(李泽湘学生、前大疆8年产业顾问、香港大学副教授)正把港大MaRS Lab的自主导航技术转化为产品,让飞行器不靠GPS和飞手遥控,自主感知、决策并完成任务。公司半年内连续完成四轮融资,累计数亿元,投资方包括耀途资本、锦秋基金、阿里巴巴。今年年底将量产第一阶段产品,面向地下管廊、隧道、仓储厂房、桥下与森林等场景,产品重量不到一千克、续航20-30分钟。
GOAG 是一种物体无关的深度生成式抓取规划器,学习特定夹爪的接触面分布,无需物体特定训练数据即可为未见物体采样有效抓取。作者在仿真与真实场景的抓取协议上验证该方法,在 MultiDex 数据集上取得 86.93% 的平均成功率,生成大量抓取时处理速度明显更快,性能与专门在该数据集上训练的方法相当。代码与视频见项目网站 https://cea-list.github.io/goagweb/。
推荐理由:论文提出与物体无关的抓取规划思路,读者可了解其如何用夹爪接触面分布替代物体特定训练数据。
CoToGrasp 是一个以特定接触拓扑为条件生成多样稳定抓取的生成框架,采用与物体无关、以夹爪为中心的工作空间实现零样本泛化。该方法完全在物体无关的方式下训练,通过特征化规范工作空间将局部物体特征投影到统一的夹爪中心域,解耦语义功能意图与物体几何。
MuJoCo 3.12.0 发布,新增带真实位置与速度设定点输入的 pid 执行器,支持积分项、设定点速率限制与前馈输入,可替代 mujoco.pid 插件。dcmotor 控制器改为按 input 签名选择 pos、vel、ff、voltage 子集,增益从电压空间改为力矩空间,旧速度模式积分项被移除。
Open Robotics 发布 gz-sim 11.0.0-pre1,修复了旋转碰撞形状下分级浮力(graded buoyancy)的计算问题(#3880)。该提交由 Carlos Agüero 签署,并标注 Assisted-by: Claude Fable 5。
8月18日,五一视界在“物理AI宏伟蓝图2030”发布会上发布 AperData 具身数据底座和 AperOne 具身应用平台,AperData 首发价 5100 元/套并已开放预定。
Hugging Face 上发布 NeDM Study 4 数据集,包含宇树 Go2 在 Chrono CRM 颗粒地形(SPH 颗粒土壤)上行走的语料、训练好的神经降维代理模型。
推荐理由:论文配套数据集公开了宇树 Go2 在颗粒地形上的语料、代理模型与微调策略,可复现其仿真到真实迁移流程。
Current Robotics 团队发布交互式世界仿真器 CurrentWorld-0,把跨本体、多视角和力-触觉预测放进同一个系统,用于机器人策略评测。团队称模型保留不同本体的 Action Subspace,可同步生成多路视角,并让力觉与触觉随动作一起变化,避免世界模型替失败策略补回成功结果。
EPFL、杜克大学与里斯本高等理工学院联合开发了仿生幼体斑马鱼机器人平台 ZBot,用于对比间歇式滑行游动与连续摆尾游动的能效。ZBot 体长 80 cm、重 2.8 kg,尾部由六个伺服电机驱动,头部集成中央控制器、高精度相机与实时功率计。实验显示间歇游动在所有可达速度下均比连续摆尾省能,但最高速度仅为连续摆尾的约 60%;团队提出执行器效率假说,认为间歇循环让电机更多工作在高效负载区间。
逐际动力联合创始人兼CTO谌骅透露,过去两年公司研发团队算力需求增长5到10倍,其与阿里云无影灵构合作,将GPU、仿真环境等搬上云端工作站,用于模型训练、仿真评测和云上研发环境。
Genesis 发布 v1.3.3,修复刚体求解器收敛回归,并新增类 torch 的 use_deterministic_algorithms 选项,可在给定机器上实现位精确可复现仿真。
Gazebo 社区宣布修复 AdvancedLiftDrag 系统的俯仰力矩计算缺陷,相关改动已在 Issue #3695 中处理。此前该系统在计算俯仰力矩时存在错误,修复后伴随行为变更,用户需注意升级后的仿真表现差异。
Open Robotics 发布 gz-sim 9.6.0,对应标签 gz-sim9_9.6.0(提交 fffcee0),由 Arjo Chakravarty 签署。该提交经 GitHub 验证签名,随附 2 个资源文件。
Open Robotics 发布 gz-sim 8.15.0,为 8.15.0 版本发布做准备,提交由 Arjo Chakravarty 签署。该版本以 gz-sim8_8.15.0 标签发布,具体更新内容未在提交信息中列出。
有开发者在 ROS Discourse 提问,是否已有人实现传感器数据和控制指令的延迟(乃至抖动)仿真,并认为在 ROS 中直观做法是类似 topic_tools/delay 的节点。目前该问题尚未给出具体实现方案或结果。
ROS 社区下一次 8 月会议将讨论如何用 Gazebo 运行强化学习算法。Gym Gazebo Sim 是一个教育软件工具包,用于帮助初学者上手。
德国卡尔斯鲁厄理工学院(KIT)设计出一套机器人拆解系统,可依据破损产品的 CAD 模型预测故障并拆解,同时保护关键零件不受损伤。系统通过数学建模判断零件自由度异常,并在拆解过程中持续校验、必要时改用铣削等方式,还可指定需完整保留的零件。该研究已在 ICRA 2026 发布,团队设想将其扩展为多机械臂协同的自动化拆解工厂。
一位开发者分享了其首个完整自主移动机器人项目:用 ROS 2 Jazzy、Gazebo Harmonic 和 Nav2 搭建的自主仓库 AMR 仿真。该机器人是差速驱动 AMR。
EdgeAI Forge 正在原型化一套本地优先的工程架构,用于生成、测试、基准测试和文档化 ROS 2 与机器视觉流水线,首个目标工作流是 ROS 2 视觉流水线生成器。
Aachal Sharma 与 Rahul Gupta 为 Gazebo Harmonic / Gazebo Sim 8 发布开源火灾仿真插件,可配置模拟火焰、烟雾粒子、热传播与基于距离和方向的火源暴露。
GZ Weather System 开源了基于 Gazebo Sim(Harmonic)内置 ParticleEmitter 的雨雪仿真世界,无需自定义渲染插件即可集成到机器人仿真中。项目提供 Rain World、Snow World 和基于 Gazebo Transport 的运行时粒子发射控制,并计划加入风效与动态天气过渡。
frontier_exploration_ros2 是一个基于 ROS 2 和 Nav2 的开源 C++ 自主探索项目,探索逻辑封装为 C++ 库,可集成到不同栈中,而不必依赖其提供的 ROS 2 节点。
Genesis 发布 v1.3.2,刚体仿真在给定机器上于 CPU 和 GPU 均实现完全确定性,并提升了刚体仿真在朝向与尺度物理不变量上的一致性及质量矩阵病态条件下的数值鲁棒性。
DARPA Lift Challenge 本周末举行,多款外形奇特的重型起重无人机设计亮相,DARPA 已录制全程直播。NASA SkyFall 火星直升机将用地面穿透雷达搜寻冰冻水,为此搭载可向下伸展的柔性织物天线,避免干扰着陆或在触地时损坏。Generalist 称 GEN-1 在适应新执行器与新机器人方面改进,内部基准提升 10-20 倍,在 NIST 板拆解等高精度任务上表现显著提升。
MIT CSAIL 与丰田研究院提出 SceneSmith,用设计师、评论者、编排者三个基于 GPT-5.2 的 VLM 智能体协作生成可直接载入物理仿真软件的 3D 室内场景,单场景物体数量最多为先前方法的六倍。
黎曼动力联合光轮智能和诺亦腾机器人共建具身智能数据底座,把采集、仿真、训练和评测接成一条线,并计划到2026年底完成100万小时机器人训练数据采集。黎曼动力此前用23.2万小时数据训练出Riemann-1.0,其前身为昆仑万维内部Matrix世界模型团队。三方还将共建数据规范、标注标准和评测基准,部分具身训练数据面向社区开源。
ROBOTIS 团队开源模块化框架 CYCLO,将 Physical AI 工作流中的数据、训练、仿真与硬件控制整合到单一流程。
面向 Scenic 概率编程语言现有及潜在用户与开发者的年度研讨会将于 8 月 20-21 日在 UC Santa Cruz 举行,该语言用于自主智能信息物理系统的环境建模与数据生成,已被用于在 Gazebo 等多种仿真器中设计评估机器人。
一位 Nav2 新手在 Isaac Sim 中用搭载单个前置 2D LiDAR 的官方 Nova Carter AMR 做导航,小型室内工厂环境正常,AMCL 定位稳定;换到大型道路环境后机器人开始 zigzag 行驶,并逐渐偏离道路甚至跑到路边,而 RViz 仍显示机器人在路中央,与 Isaac Sim 中的实际位置明显不一致。
MiniWorld 是一个从零训练流式视频世界模型的可复现框架,采用块因果视频扩散 Transformer,在预训练 Video VAE 的潜空间中以 Flow Matching 训练,并基于 Diffusion Forcing 使用分块非递减噪声调度和两阶段继续训练。
推荐理由:MiniWorld 给出从零训练流式视频世界模型的完整方案与代码,读者可据此评估单机 8 卡复现的可行性。
Push-Wiper 将黏性污渍清洁重构为聚集问题,用海绵通过分段推扫轨迹逐步聚集污渍,再经后处理分离聚集物并实现海绵自清洁。该方法用 Diffusion Policy 生成自适应推扫动作序列,经任意表面位姿插值器(ASPI)和力位混合控制器执行,清洁得分(去除污渍面积百分比)最高比基线方法高 130%。
QERRA-v2 Classical 发布仿真 Demo 3,在 Webots R2025a 中用 PAL Robotics TIAGo 人形机器人测试 3 阶段办公室场景,集成 SEMEV-12 道德引擎与 PyTrees 行为树中间件。
Gazebo PMC 于 2026-08-03 召开周会,确认 2026-09-21 举行 PMC 晚餐会,并计划本周在 build.osrfoundation.org 的 GitHub 登录端点部署 Anubis 前端防护以缓解 Jenkins 爬虫压力。