SyncWorld:视觉校准让世界模型成为零样本模拟器
Hugging Face 论文页介绍 SyncWorld,一种通过视觉校准让世界模型在未见相机、环境和本体上做上下文机器人世界建模的方法,无需下游训练。该方法以少量视觉交互作为上下文,尝试模拟机器人控制带来的视觉后果。
推荐理由:SyncWorld 提出用视觉校准让世界模型在未见相机与环境上做零样本仿真,读者可了解其免下游训练的思路。
Hugging Face 论文页介绍 SyncWorld,一种通过视觉校准让世界模型在未见相机、环境和本体上做上下文机器人世界建模的方法,无需下游训练。该方法以少量视觉交互作为上下文,尝试模拟机器人控制带来的视觉后果。
推荐理由:SyncWorld 提出用视觉校准让世界模型在未见相机与环境上做零样本仿真,读者可了解其免下游训练的思路。
Hugging Face 上线论文页面 SAEScientist-Bench,提出用基准测试检验 AI 智能体能否自主完成 SAE 可解释性研究。该页面目前仅开放论文讨论,未披露任务设置、评测指标或实验结果等具体信息。
Hugging Face 上线论文页《Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails》,探讨在策略修正对较弱模型的提升作用。论文指出,在模仿学习失效的场景下,该方法能帮助弱模型追赶。
DianShi-RxnDB 是一个大规模、细粒度的有机反应数据平台,通过全自动流水线构建,面向研究者与 AI Agent。该论文页面已在 Hugging Face 上线并开放讨论。
Hugging Face 上线论文页《Scores Alone Do Not Prove Discovery: The Discovery Certification Protocol for Auditing AI Research Agents》,提出用于审计 AI 研究智能体的 Discovery Certification Protocol,主张仅凭分数不足以证明发现。
MuJoCo 3.13.0 发布,新增 discrete 积分器,将约束求解与隐式速度更新合并为一步,使被动弹簧和执行器位置增益在远超显式稳定极限的时间步下保持稳定。该版本还新增 Python 3.15(GIL 与自由线程)支持、站点几何关联网格、传感器 cutoff 属性,并移除 implicit/implicitfast 下 flex 有效度量的特例,相关模型需改用 discrete 积分器。
美国机器人研究人员与产业界正寻求一套连贯的国家机器人战略,在维持基础研究与创新的同时提升本土机器人的生产与采用。文章指出,美国虽是全球第三大工业机器人消费国(去年物流、包装、汽车等行业采用量增长11%),却缺乏本土制造基础设施,多数基础工业机器人依赖进口,而日本进口依赖仅2%。国防部2026财年为自主系统申请134亿美元预算,2027年再申请536亿美元用于自主系统与无人机。
汉朔科技与X-Era Lab(拓元智慧)合作,将具身智能机器人带入真实零售门店,聚焦巡检、盘点、补货三类任务,汉朔巡检机器人已在国内和海外商场开始POC测试。汉朔已在近7万家门店部署电子价签网络,为机器人提供货架语义坐标;X-Era Lab的原生世界动作模型VWA仅用10亿参数,可在32 TOPS算力硬件上端侧部署,推理时延压缩至毫秒级。
Scalabot 发布首个世界模型 HERON-World Model,输入当前画面和待执行动作即可预测后续画面,并支持多智能体动作配合与相互影响的预测。
9月3日,宜宾国际会展中心举办“江源杯”2026具身智能场景技能挑战赛,55支机器人团队围绕产线搬运、零件分拣装配、厂区巡检、配送、衣物整理、饮品制作、应急救援等真实任务展开实机比拼,130余支团队报名。
Erin Kennedy 在 Hackaday Europe 2026 的演讲中分享了户外机器人设计经验,围绕沙滩、水下和空中三类环境展开。她以清理海滩塑料垃圾的机器人、捕捉入侵海胆的 Otter Force One 和借风力推进、面向火星长距离探索的 Atmosphinder 为例,给出应对沙粒磨损电机、水下密封与浮力变化等实用技巧。
IEEE Spectrum 记者在加州帕洛阿尔托试乘 Rivian R1S 的 Autonomy+ 系统,该系统属 SAE L2+,需驾驶员全程关注,计划今年年底前后随全新 R2 SUV 首发,并以 OTA 推送给最新 R1S 和 R1T,订阅价每月 49.99 美元或一次性 2500 美元。
Fast DDS 发布 v2.14.7,修复 18 项 CVE,涉及访问控制解析器、反序列化及 PartitionQosPolicy CDR 反序列化整数溢出(GHSA-8g7x-c9fg-g6mh),相关补丁来自私下审查分支。
荷兰医疗机器人公司 Vitestro 的自主采血设备 Aletta 于 8 月 19 日获美国 FDA 授权,可在非住院场景用于成人采血,此前已获欧洲监管机构批准。荷兰 1600 多人的临床试验显示,Aletta 首针采血成功率为 94.5%,一名采血员可同时监督最多三台机器。专家关注近红外成像对深色皮肤的偏差风险,Vitestro 称超声传感器不受肤色影响,但相关数据尚未发表。
Zenoh 发布 1.10.1,为 TransportUnicast API 新增 close_link 方法。该版本修复了回环定位器的 gossip 探测、REST 插件从编码中提取 content-type HTTP 头,以及空 scout 定位器下待处理连接未清除的问题。
本末科技推出全球首款整机模块化具身智能机器人 D1,3 秒内可拆开或合体,在双轮足、四轮足等形态间自由切换,双轮足与四轮足共用一套算法体系。其直驱动力模组 2025 年出货约 850 万套,占中国消费机器人直驱动力模组市场 61.1% 份额;轮足整机已出口全球 50 多个国家和地区。
BBC 新情景喜剧《Ann Droid》设想机器人 Linda 为独居老人提供陪伴与照护,卡迪夫大学社会照护与以人为中心机器人研究者借此讨论机器人能否缓解老年人孤独。
GOSIM Shenzhen 2026 将于 10 月 16–17 日在深圳南山伊敦酒店举办,这是该开源技术大会首次来到深圳,汇聚 150+ 国际讲师和 2000+ 全球开发者。
智象未来(HiDream.ai)发布具身世界模型HiDream-O1-Embodied,强化机器人物理感知与动态预判能力,打通图像、视频、3D、动作等模态。该模型首次参评具身智能仿真评测平台RoboColiseum,在扰动适应(Robustness)子榜以平均分0.692登顶榜首。
Genesis 发布 v1.4.0,支持将场景连同完整轨迹导出为独立归档,可在任意机器上通过 gs replay 实现位精确回放,目前仅支持刚体求解器。该版本还新增在内存中保存与恢复已构建场景、在连杆任意局部点施加外部力旋量,并修复了大量与资产解析相关的缺陷。
Travis Kalanick 的 Atoms 正筹备招聘与收购,可能进军自动驾驶出租车领域,并已与 Uber 讨论其 robotaxi 技术的使用。Uber 已向 Atoms 投资 1 亿美元,此前 Atoms 完成由 Andreessen Horowitz 领投的 17 亿美元融资。消息称 robotaxi 并非 Atoms 的全部计划,该公司还收购了自动驾驶采矿初创公司 Pronto。
国内创业公司可可矩阵(COCO Matrix)正把In-Context Learning做成具身智能的底层范式,思路是将后训练的ICL前置到预训练阶段。创始人高宇翔称核心团队到齐后不到一个月即拿到验证技术方案可行性的核心证据,其条件表征模型已在八九类视觉任务上验证,动作头压到约60M参数效果依然可用。
飞渡科技自研空间智能“峥嵘大模型”获HICOOL 2026全球创业者峰会大赛一等奖,该模型为国内首个通过国家备案的工业级空间智能大模型。其洪涝推演链路支持动态边界控制与真实世界1:1验证,大范围流域全域洪涝推演耗时从以天为单位压缩到分钟级,暴雨洪涝仿真系统准备周期从数月压缩到数日、成本降至原有方法的10%。天马科创投合伙人Bill Reichert赛后邀请飞渡明年赴硅谷参加全球投资人峰会路演。
澳大利亚昆士兰大学 Biorobotics Lab 研发出半机械蟑螂“Paraborg”,在约 40 克重的巨型穴居蟑螂(Macropanesthia rhinoceros)触角和尾须植入电极,用游戏手柄无线操控其左右转向、前进或停止,并可搭载无线摄像头或弹簧驱动的注射器。
光象科技联合清华大学李升波教授课题组发布第一代物理原生世界模型 Phi-WM 1.0 ActEffect,让受控世界模型只在训练阶段比较三版动作提案的后果并反馈给策略,训练完成后退出部署链路。
据知情人士透露,出隐身不足三个月的遥操作数据采集初创公司 XDOF 正进行后期谈判,拟由 8VC 领投 B 轮,估值约 12 亿美元。该公司由 UC Berkeley 研究者 Philipp Wu 和 Fred Shentu 于 2024 年创立,年化营收接近 5000 万美元,此前 6 月刚完成 7000 万美元 A 轮。
SteadyTray 提出分层强化学习架构 ReST-RL,将运动与负载稳定解耦,在宇树 G1 人形硬件上实现零样本仿真到真实迁移,可应对多种物体与外力扰动。Agility Robotics 的视频展示了人形机器人拖动沙发的场景。
NASA 计划在 2026 年底的 IM-3 发射中把三台小型月球车送上月球,执行 CADRE 任务,它们将在约两周内自主组队测绘地形,自行推选领导者、分配任务,并在某台电量不足时重新规划。
星尘智能基座模型团队发布在线强化学习框架 SmoothRL,用于大模型异步推理成为真实部署常态后的策略后训练。它把 action chunk 按执行状态分为已提交、执行和丢弃三个区域,只让梯度穿过真正执行的 Execution Region,并在训练 rollout 中直接运行异步推理。
World Labs于9月2日发布多模态世界模型Atlas,可将文字、图像、视频和3D信息放入统一空间上下文,实现三维场景重建与新视角生成。国内团队影溯早在今年3月已开源具备类似能力的InSpatio-World,其升级版本即将发布并继续开源。
星宇股份7月招入440名2026届毕业生后,一个多月内分批约谈其中107人,要求以「个人原因」主动离职或转岗车间操作工,8月25日常州市人社局通报其协商「方法简单生硬」,公司随后致歉并发放3个月求职生活补贴。这家车灯龙头2025年10月成立全资子公司星宇机器人,2026年1月引入节卡机器人持股30%,由周晓萍之子周宇恒执掌,只做头部交互模组、光学模组和机器人蒙皮及结构件,首批交付仍为样件。
嬴彻科技宣布其卡车自动驾驶商业运营里程突破10亿公里,称在中国卡车智驾市场份额超90%,高速网络覆盖率达97%。公司同时提出原生于货运场景的货运物理AI技术底座,包含货运原生智能、场景智能与运营智能三部分,其中货运世界模型以真实货运数据重建车辆与交通参与者交互,ROSL场景库已积累几十万个高价值场景。
Tsubaki KabelSchlepp 推出专为六轴关节机器人复杂运动设计的 Robotrax 三维电缆拖链系统,通过贯穿每个链节的中央钢缆吸收主要拉伸载荷,可承受最高 10 g 加速度。
Amazon 旗下 Zoox 将其拉斯维加斯商业 robotaxi 服务扩展至哈里·里德国际机场,本周四起乘客可叫车往返机场。Zoox 于 8 月 10 日开始收费运营,此前获得为期两年、每年最多部署 2500 辆车的联邦安全标准豁免。Zoox 是目前唯一在拉斯维加斯机场运营的 robotaxi 公司,其车辆在机场两个航站楼行李提取处附近接送乘客。
德州农工大学团队研发的 1.8 米宽、150 公斤充气机器人 RoboBall III,通过内部摆锤移动重心滚动前进,仅用两个执行器,可翻越障碍并爬上 20 度斜坡。该机器人设想由月球车运至陨石坑边缘后自主下探,并用小型火箭将地质样本射回坑外,相关设计与德州采石场测试结果已发表于 IEEE Transactions on Field Robotics。
影眸 Hyper3D 发布世界生成模型 WorldGen,上传一张场景图后约 2 到 3 分钟可生成完整 3D 场景,场景内每件资产可单独移动、替换,并保留空间与物理关系。
它石智航通用具身大模型 AWE3.7(AI World Engine)在十天内连续发布一系列任务,用同一套基座模型覆盖工业产线、物流作业、生活服务与移动操作等场景。
研究者提出 LLAMIA-Bench,包含六项协作国际象棋任务,覆盖行为模仿、状态评估和自然语言解释三个维度。通过潜在状态内化将子智能体的连续表示直接投影为 LLM 的学习状态 token,实验发现相比文本化整合存在持续的"文本化债务",且该差距随模型从 4B 扩展到 14B 参数依然存在。
神秘具身团队放出代号“MVP”(Make Veritable People)的自进化模型系列 Demo,展示机器人在木棍推搡下端水不洒并同时扶住易拉罐、zero-shot 完成客厅收纳(团队称成功率 80%)、两台不同型号机器人跨本体协作抖床单,以及一次收纳 4 件物品的长程任务。团队称训练全部来自人类视频,并计划让机器人进入开放环境上街展示。
自变量发布全新灵巧操作系统 TwinDEX,在后训练阶段真机遥操数据为 0 的情况下,用几百条无本体数据完成化学实验场景中的旋拧瓶盖、注射器推注等精细操作。该系统由数据采集硬件、机器人末端执行器、数据处理管线和模型训练流程组成,采用三指九自由度和数采与执行同构设计,官方称单位时间有效轨迹约为传统真机遥操的 5.3 倍。