大晓机器人等发布人–场景交互重建框架 HSImul3R,被 ECCV 2026 接收
大晓机器人联合南洋理工大学 S-Lab、上海人工智能实验室发布人–场景交互重建研究 HSImul3R,已被 ECCV 2026 接收。
大晓机器人联合南洋理工大学 S-Lab、上海人工智能实验室发布人–场景交互重建研究 HSImul3R,已被 ECCV 2026 接收。
蚂蚁灵波发布LingBot-World 2.0轻量版,参数规模1.3B,面向消费级单卡GPU设计,可在本地实现实时世界生成。该版本延续7月开源的14B主模型路线,先训练Causal World因果预训练底座,再经一致性蒸馏与DMD蒸馏压缩去噪步数,并让Student在自身长时self-rollout轨迹上训练以减少累计漂移。
Skild AI 在首次商业部署十个月后年经常性收入突破 1 亿美元,其中已确认 5000 万美元,客户超过 60 家,覆盖搬运、配送、巡检、安保、餐饮及仓库、工厂、数据中心等场景。
推荐理由:Skild AI 公布 10 个月实现 1 亿美元 ARR 的部署结构,并解释部署数据如何反哺通用模型。
Anthropic 前沿红队开发了新评估,衡量 AI 在战术情报定位(如依据碎片信息定位人员)和常规武器开发(如设计无人机打击移动目标)上的能力,部分军事与情报任务已达到此前仅少数受训专家可完成的水平。
安努智能一周内发布六款模型,包括实时长视频生成模型Helios、软物体仿真平台SimLab、世界模型ActiWorld、强化学习工具EvoHIL、工业垂类模型AnuVerse-0.5和端到端部署系统Nexus,覆盖数据生成、认知理解、训练进化、动作执行到端到端部署环节。
脸谱心智于 2026 年 6 月发布技术报告《Looped World Models》(arXiv: 2606.18208),提出 LoopWM,称其为首个将循环 Transformer 架构用于世界建模的方法,论文登上 Hugging Face Papers 当日 Top 1。
PlannerForge 是一个 LLM-agent 框架,把自动驾驶场景测试的场景生成、检索、修改、ADS 执行与结果分析统一到同一流程,并新增 ADS Enhancement 与 ADS Benchmarking 两个阶段。
推荐理由:论文把场景生成到评估串成统一 LLM-agent 流程,并给出开源模型与商业 API 的对比数据。
京东在JDD大会上发布实时可交互世界模型JoyAI-Echo WM,在WBench Navigation评测中以81.6分排名第一。京东云已与摩尔线程等打造国产万卡集群并规划建设十万卡集群,同时推进1000万小时具身数据采集,首批开源数据集EgoLive已对外开放。京东还启动物理AI加速计划,计划5年内采购300万台机器人、100万台无人车及10万架无人机。
Hugging Face 博客介绍如何用 AsyncGRPOTrainer 的 LoRA 适配器同步,在 HF Jobs 上把训练与 vLLM 推理拆到不同机器,通过挂载 Storage Bucket 传递几 MB 的 rank-1 适配器,无需 NCCL。
推荐理由:原文给出跨机异步 GRPO 训练的可复用工程方案与五轮调优数据,读者可据此判断瓶颈定位与提速路径。
Hugging Face 上出现 quangnd58/evo1-so101-multitask,这是基于 OpenGVLab/InternVL3-1B 视觉语言主干、在 hungho77/so101-multitask 数据集上训练的 Evo-1 第二阶段检查点,用于 SO-101 机械臂的 3 项任务。
Hugging Face 论文页介绍 SyncWorld,一种通过视觉校准让世界模型在未见相机、环境和本体上做上下文机器人世界建模的方法,无需下游训练。该方法以少量视觉交互作为上下文,尝试模拟机器人控制带来的视觉后果。
推荐理由:SyncWorld 提出用视觉校准让世界模型在未见相机与环境上做零样本仿真,读者可了解其免下游训练的思路。
Hugging Face 上线论文页面 SAEScientist-Bench,提出用基准测试检验 AI 智能体能否自主完成 SAE 可解释性研究。该页面目前仅开放论文讨论,未披露任务设置、评测指标或实验结果等具体信息。
Hugging Face 上线论文页《Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails》,探讨在策略修正对较弱模型的提升作用。论文指出,在模仿学习失效的场景下,该方法能帮助弱模型追赶。
DianShi-RxnDB 是一个大规模、细粒度的有机反应数据平台,通过全自动流水线构建,面向研究者与 AI Agent。该论文页面已在 Hugging Face 上线并开放讨论。
Hugging Face 上线论文页《Scores Alone Do Not Prove Discovery: The Discovery Certification Protocol for Auditing AI Research Agents》,提出用于审计 AI 研究智能体的 Discovery Certification Protocol,主张仅凭分数不足以证明发现。
MuJoCo 3.13.0 发布,新增 discrete 积分器,将约束求解与隐式速度更新合并为一步,使被动弹簧和执行器位置增益在远超显式稳定极限的时间步下保持稳定。该版本还新增 Python 3.15(GIL 与自由线程)支持、站点几何关联网格、传感器 cutoff 属性,并移除 implicit/implicitfast 下 flex 有效度量的特例,相关模型需改用 discrete 积分器。
美国机器人研究人员与产业界正寻求一套连贯的国家机器人战略,在维持基础研究与创新的同时提升本土机器人的生产与采用。文章指出,美国虽是全球第三大工业机器人消费国(去年物流、包装、汽车等行业采用量增长11%),却缺乏本土制造基础设施,多数基础工业机器人依赖进口,而日本进口依赖仅2%。国防部2026财年为自主系统申请134亿美元预算,2027年再申请536亿美元用于自主系统与无人机。
汉朔科技与X-Era Lab(拓元智慧)合作,将具身智能机器人带入真实零售门店,聚焦巡检、盘点、补货三类任务,汉朔巡检机器人已在国内和海外商场开始POC测试。汉朔已在近7万家门店部署电子价签网络,为机器人提供货架语义坐标;X-Era Lab的原生世界动作模型VWA仅用10亿参数,可在32 TOPS算力硬件上端侧部署,推理时延压缩至毫秒级。
Scalabot 发布首个世界模型 HERON-World Model,输入当前画面和待执行动作即可预测后续画面,并支持多智能体动作配合与相互影响的预测。
9月3日,宜宾国际会展中心举办“江源杯”2026具身智能场景技能挑战赛,55支机器人团队围绕产线搬运、零件分拣装配、厂区巡检、配送、衣物整理、饮品制作、应急救援等真实任务展开实机比拼,130余支团队报名。
Erin Kennedy 在 Hackaday Europe 2026 的演讲中分享了户外机器人设计经验,围绕沙滩、水下和空中三类环境展开。她以清理海滩塑料垃圾的机器人、捕捉入侵海胆的 Otter Force One 和借风力推进、面向火星长距离探索的 Atmosphinder 为例,给出应对沙粒磨损电机、水下密封与浮力变化等实用技巧。
IEEE Spectrum 记者在加州帕洛阿尔托试乘 Rivian R1S 的 Autonomy+ 系统,该系统属 SAE L2+,需驾驶员全程关注,计划今年年底前后随全新 R2 SUV 首发,并以 OTA 推送给最新 R1S 和 R1T,订阅价每月 49.99 美元或一次性 2500 美元。
Fast DDS v2.14.7 发布,修复了 CVE-2026-22591、CVE-2026-45094 等 17 个 CVE 及 GHSA-8g7x-c9fg-g6mh,涉及访问控制解析器、反序列化和 PartitionQosPolicy CDR 反序列化整数溢出。
智元人形机器人 A3 与 X2 在 IFA 2026 获 IFA 创新奖及多家国际科技媒体奖项,A3 拿下 Best in IFA Next & Emerging Technologies,X2 获同类别 Honoree。
荷兰医疗机器人公司 Vitestro 的自主采血设备 Aletta 于 8 月 19 日获美国 FDA 授权,可在非住院场景用于成人采血,此前已获欧洲监管机构批准。荷兰 1600 多人的临床试验显示,Aletta 首针采血成功率为 94.5%,一名采血员可同时监督最多三台机器。专家关注近红外成像对深色皮肤的偏差风险,Vitestro 称超声传感器不受肤色影响,但相关数据尚未发表。
Zenoh 发布 1.10.1,为 TransportUnicast API 新增 close_link 方法,并修复 gossip 对回环定位器的探测、REST 插件从 encoding 提取 content-type HTTP 头,以及空 scout 定位器下未清除待处理连接的问题。@stan603-source 在 #2759 中完成首次贡献,完整变更记录见 1.10.0...1.10.1。
本末科技推出全球首款整机模块化具身智能机器人 D1,3 秒内可拆开或合体,在双轮足、四轮足等形态间自由切换,双轮足与四轮足共用一套算法体系。其直驱动力模组 2025 年出货约 850 万套,占中国消费机器人直驱动力模组市场 61.1% 份额;轮足整机已出口全球 50 多个国家和地区。
BBC 新情景喜剧《Ann Droid》设想机器人 Linda 为独居老人提供陪伴与照护,卡迪夫大学社会照护与以人为中心机器人研究者借此讨论机器人能否缓解老年人孤独。
GOSIM Shenzhen 2026 将于 10 月 16–17 日在深圳南山伊敦酒店举办,这是该开源技术大会首次来到深圳,汇聚 150+ 国际讲师和 2000+ 全球开发者。
智象未来(HiDream.ai)发布具身世界模型HiDream-O1-Embodied,强化机器人物理感知与动态预判能力,打通图像、视频、3D、动作等模态。该模型首次参评具身智能仿真评测平台RoboColiseum,在扰动适应(Robustness)子榜以平均分0.692登顶榜首。
Genesis 发布 v1.4.0,支持将场景连同完整轨迹导出为独立归档,可在任意机器上通过 gs replay 实现位精确回放,目前仅支持刚体求解器。该版本还新增在内存中保存与恢复已构建场景、在连杆任意局部点施加外部力旋量,并修复了大量与资产解析相关的缺陷。
Travis Kalanick 的 Atoms 正筹备招聘与收购,可能进军自动驾驶出租车领域,并已与 Uber 讨论其 robotaxi 技术的使用。Uber 已向 Atoms 投资 1 亿美元,此前 Atoms 完成由 Andreessen Horowitz 领投的 17 亿美元融资。消息称 robotaxi 并非 Atoms 的全部计划,该公司还收购了自动驾驶采矿初创公司 Pronto。
国内创业公司可可矩阵(COCO Matrix)正把In-Context Learning做成具身智能的底层范式,思路是将后训练的ICL前置到预训练阶段。创始人高宇翔称核心团队到齐后不到一个月即拿到验证技术方案可行性的核心证据,其条件表征模型已在八九类视觉任务上验证,动作头压到约60M参数效果依然可用。
飞渡科技自研空间智能“峥嵘大模型”获HICOOL 2026全球创业者峰会大赛一等奖,该模型为国内首个通过国家备案的工业级空间智能大模型。其洪涝推演链路支持动态边界控制与真实世界1:1验证,大范围流域全域洪涝推演耗时从以天为单位压缩到分钟级,暴雨洪涝仿真系统准备周期从数月压缩到数日、成本降至原有方法的10%。天马科创投合伙人Bill Reichert赛后邀请飞渡明年赴硅谷参加全球投资人峰会路演。
澳大利亚昆士兰大学 Biorobotics Lab 研发出半机械蟑螂“Paraborg”,在约 40 克重的巨型穴居蟑螂(Macropanesthia rhinoceros)触角和尾须植入电极,用游戏手柄无线操控其左右转向、前进或停止,并可搭载无线摄像头或弹簧驱动的注射器。
光象科技联合清华大学李升波教授课题组发布第一代物理原生世界模型 Phi-WM 1.0 ActEffect,让受控世界模型只在训练阶段比较三版动作提案的后果并反馈给策略,训练完成后退出部署链路。
据知情人士透露,出隐身不足三个月的遥操作数据采集初创公司 XDOF 正进行后期谈判,拟由 8VC 领投 B 轮,估值约 12 亿美元。该公司由 UC Berkeley 研究者 Philipp Wu 和 Fred Shentu 于 2024 年创立,年化营收接近 5000 万美元,此前 6 月刚完成 7000 万美元 A 轮。
SteadyTray 提出分层强化学习架构 ReST-RL,将运动与负载稳定解耦,在宇树 G1 人形硬件上实现零样本仿真到真实迁移,可应对多种物体与外力扰动。Agility Robotics 的视频展示了人形机器人拖动沙发的场景。
NASA 计划在 2026 年底的 IM-3 发射中把三台小型月球车送上月球,执行 CADRE 任务,它们将在约两周内自主组队测绘地形,自行推选领导者、分配任务,并在某台电量不足时重新规划。
星尘智能基座模型团队发布在线强化学习框架 SmoothRL,用于大模型异步推理成为真实部署常态后的策略后训练。它把 action chunk 按执行状态分为已提交、执行和丢弃三个区域,只让梯度穿过真正执行的 Execution Region,并在训练 rollout 中直接运行异步推理。