意大利独角兽 Exein 融资 2.7 亿美元,押注物理 AI 安全
意大利初创公司 Exein 以 17 亿美元估值完成 2.7 亿美元融资,由 Headline 领投,主打为物理 AI 提供网络安全层。其最新产品 Photon 是内核级运行时安全方案,公司称已覆盖超 20 亿台联网设备,并正训练面向物理 AI 安全的基础模型,计划 2027 年第一季度就绪。
意大利初创公司 Exein 以 17 亿美元估值完成 2.7 亿美元融资,由 Headline 领投,主打为物理 AI 提供网络安全层。其最新产品 Photon 是内核级运行时安全方案,公司称已覆盖超 20 亿台联网设备,并正训练面向物理 AI 安全的基础模型,计划 2027 年第一季度就绪。
无问芯穹联合清华大学、上海交通大学开源具身智能端侧推理引擎 APXInf,支持 RTX 4090、Jetson Orin、Jetson Thor 等平台,首发支持 PI 0.5 与 WALL-OSS 两款具身模型。
智象未来(HiDream.ai)发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0(HD-V1),支持文本、图片、视频等多模态输入,可一键直出 5–20 秒 1080p 视频。
ROS 2 Humble Hawksbill 发布 Patch Release 15(2026-09-14),提供二进制包,并为 Ubuntu Jammy 提供 Debian 包。由于 Humble 面向已停止支持的 Windows 10,本次不再提供 Windows 二进制包。
Waymo 在内华达州监管机构最终批准数周后,开始在拉斯维加斯向公众开放 robotaxi 服务,首批投入数十辆 Ojai 厢式车,服务范围覆盖 589 号公路以南的 Strip 至 Boulder Junction,公众需申请邀请码。
首届蚂蚁灵波具身大模型挑战赛在外滩大会启动,由蚂蚁灵波、魔搭社区和阿里云天池共同发起,以 2026 年 7 月开源的 LingBot-VLA 2.0 预训练模型为技术基座,面向全球开发者开放。大赛报名及线上初赛持续至 10 月 26 日,初赛设必做的 RoboTwin 2.0 仿真任务和可选真机创新任务,入围团队将于 11 月 13 日至 15 日在上海参加线下真机黑客马拉松。
生数科技发布世界模型 Motus2,在同一模型中整合行动、预测与评估三种能力,形成生成动作、预测后果、评估结果、更新策略的闭环,探索递归自我改进(RSI)。真机测试中,手机放置与多指操作两项任务基础策略平均成功率 65%,加入规划为 67.5%,加入基于模型的强化学习为 72.5%,两者结合达 75%;加入触觉后抽取纸杯与撕纸任务平均成功率从 60% 提升至 72.5%。
推荐理由:生数科技 Motus2 把动作生成、后果预测与价值评估放进同一世界模型,读者可了解其闭环自进化机制与真机数据。
2026 年 8 月,北京世界机器人大会汇聚约 300 家企业、展出超 2000 款产品,宇树“超人”人形机器人亮相,其 IPO 首日收盘较发行价上涨 460%,但到 8 月 28 日已回落近 30%。
2026崇礼论坛9月12日在崇礼·太舞小镇举行,以“未来此刻”为主题,参会嘉宾与观众超700人,由太舞小镇、甲子光年、破圈文化联合主办。论坛设置智能生活方式、Chongli AI Film Lab、AI Builders Show三个专场,并发布《2026AI生活方式白皮书》与2026「AI NEXT 20」榜单,同时启动首届崇礼AI短片节。
深度机智于 2026 年 9 月 9 日发布物理基座模型 PhysBrain 1.5,8B 版本在 28 项公开基准上取得 72.5 综合均分,位列参评开源模型首位,与 GPT-6 Astra(73.3)、Gemini 3.6 Flash(73.0)差距在 1 分以内。
Lyft 本周在纳什维尔上线 Waymo 无人驾驶出租车,这是其首次真正进入无人类安全员的商业 robotaxi 服务。Lyft 通过全资子公司 Flexdrive 负责车辆整备、维护及基础设施与站点运营,乘客可在 Lyft 应用内按可用性匹配 Waymo 车辆。
亮源新创过去一个多月连续发布LightParkour、LightNav-0和Light REACT三项技术,分别面向复杂接触技能扩展、通用导航和全身韧性控制。
Genesis 发布 v1.4.1,重点提升大规模场景下 CPU 与 GPU 的性能,速度随岛屿数量呈亚线性下降,不平衡场景的 Jacobi 均衡开销大幅降低,接触密集场景在 CPU 上明显加速。新版本支持不含 joint2 的 MJCF 关节等式,并修复 glTF 归一化整数访问器解码、法线与纹理坐标保留、MJCF 关节执行器力范围等问题。
生数科技发布世界模型 Motus2,在同一模型中整合行动、预测与评估三种能力,形成生成动作、预测后果、评估结果、更新策略的闭环,探索递归自我改进(RSI)。真机测试中,手机放置与多指操作两项任务基础策略平均成功率 65%,加入规划升至 67.5%,加入基于模型的强化学习达 72.5%,两者结合达 75%。
推荐理由:生数 Motus2 把动作生成、后果预测与价值评估放进同一世界模型,读者可了解闭环自进化的实现路径与真机数据。
Mecka AI 正以约 5 亿美元估值完成红杉资本领投的新一轮融资,交易条款尚未最终确定。这家 2024 年成立的初创公司通过体感传感器和智能手机付费采集人们做咖啡、修车等日常任务的"自我中心"运动数据,用于训练人形机器人等机器人模型。此前三个月,它刚完成由 Framework Ventures 领投的 6000 万美元融资,并预计 2026 年底年化收入达 1 亿美元。
World in World 是一种免训练的推理时接口,让冻结的自回归视频世界模型支持灵活的相机与时间控制。它把源视频观测、目标视角场景投影、几何渲染和缓存外已生成状态等异构证据转为带相机与时间标签的干净视觉状态,通过原生自注意力读取,并用对应路由器和 EWA 逐通道调节注意力。同一冻结骨干可支持相机控制重渲染、长时程回访和人体动作迁移。
Hugging Face 论文页介绍 Recursive Code World Models(RCWM),一种从单张参考图像以可执行代码递归重建复杂 3D 世界的框架。
ETH Zurich 机器人系统实验室研究人形机器人猴杠穿越,机器人需跳上稀疏三维结构、通过稀疏横杆交互完成穿越并安全落地。宇树全面开源 UnifoLM-WLA-1.0 具身基础模型,称在多个基准上取得开源模型中的新 SOTA,单一模型可协调桌面与全身移动操作,支持跨任务和跨末端执行器泛化。
8 月 25 至 27 日,UK RAS STEPS 成员在约克大学安全自主研究所参加为期三天的 Micromaze 机器人黑客松,组队设计、搭建并编程可穿越递增复杂度迷宫的自主机器人。
高德9月10日宣布扫街榜全面AI化,升级后的2026版用AI算法理解不同导航到店行为的评分权重。其空间智能核心引擎ABot-Earth 0.7被称为全球首个3D原生城市世界模型,仅需一张卫星图或一段文字,在消费级GPU上跑10分钟即可生成真实街景3D城市,效率比传统方法提升1000倍,已覆盖190多个国家、300多座城市。
九识9月10日在广州宣布完成“城市级物理AI”战略升级,推出“九识租车”小程序并开放无人运力加盟,同时与广汽领程、广州公交集团等签署合作协议。其RoboVan车队规模已超3万台,在全球300多座城市常态化运营,累计运营里程突破2.5亿公里。九识租车此前已在45座城市、300家客户中试点,累计完成1500+笔租赁订单,运行里程超100万公里。
[heychaostheory] 用现成金属机器人底盘和 3D 打印外壳做出一台自主老鼠机器人,内部搭载 Arduino Uno、L298 电机驱动板和超声波避障传感器。它配有 LED 闪烁灯,按下派对模式按钮可通过 DFPlayer Mini 模块播放音乐。整机可全尺寸低成本自制。
研究者提出 SpatialBlock,通过合成积木堆叠任务提升大型视觉语言模型(LVLM)的 3D 空间推理能力。其构建的 SpatialBlock-15k 数据集包含 15,000 个积木堆叠问题,覆盖 3D 到 2D 投影、视角变换和结构组合,并加入受控颜色调制作为视觉线索。实验显示,用该数据集训练的 LVLM 在直接回答和基于推理的预测两种方式下均显著优于基线,并能泛化到真实世界空间任务。
IEEE Spectrum 报道,学术实验室与创业公司正竞相构建触觉数据集与使用技术,以突破精细操作瓶颈。
Mbodi 联合创始人 Xavier Chi 在 TechCrunch 播客 Build Mode 中表示,机器人不会迎来单一的 ChatGPT 式突破,人形形态也非必要。Mbodi 用自然语言让人教工业机器人新技能,并与 ABB Robotics 合作进入工厂和仓库,近期在八小时测试中取得 99.6% 成功率。
Mbodi 联合创始人 Xavier Chi 在 TechCrunch 播客 Build Mode 中介绍,其 AI 软件让人用自然语言教工业机器人新技能,并与 ABB Robotics 合作进入工厂和仓库。他透露 Mbodi 在八小时测试中达到 99.6% 成功率,并认为机器人不会出现单一的 ChatGPT 式突破,可靠性才是进入生产的关键。
论文提出 World Model RL(WMRL),用学习到的世界模型替代环境执行,以缓解自动研究智能体强化学习后训练中环境执行成为瓶颈的问题。作者进一步引入 Online Debiasing 与 Inverse-Variance Denoising 分别抵消世界模型奖励的偏差与噪声,并从理论上证明两者严格改善收敛保证。
推荐理由:论文提出用世界模型替代环境执行来加速自动研究智能体的强化学习后训练,并给出理论收敛保证与跨任务迁移证据。
Skild AI 发布 S1 机器人基础模型,可用单段视频演示作为提示,在不更新权重、不做任务专项后训练的情况下执行此前未见的长程任务,最长约 10 分钟,涵盖装盆、做煎饼、手冲咖啡和套件装配等。
推荐理由:S1 用单段视频提示完成长程任务且不更新权重,读者可据此判断免重训部署路径的可行边界。
全球 Robotaxi 市场预计到 2035 年达 4000 亿美元,超 600 万辆商用车上路,NVIDIA 以训练、仿真验证、车载三计算机架构支撑商业化车队规模化部署。
Maven Robotics 完成 1 亿美元融资,投资方包括 RoboStrategy、LocalGlobe、Vine Ventures 和 XTX Ventures,并计划生产 250 台第三代机器人、启动第四代平台设计。
LUCAS 3 是瑞典隆德大学研发的电动心肺复苏设备,以约 102 次/分钟、约 53 mm 深度对成人胸骨持续按压,替代人工胸外按压。4471 人的 PARAMEDIC 试验显示其 30 天生存率为 6.3%,人工按压为 6.8%,差异不显著;2589 人的 LINC 试验中 4 小时生存率分别为 23.6% 和 23.7%。
9月10日,阿里巴巴集团旗下高德发布3D原生城市世界模型ABot-Earth 0.7,支持从星球到街景的一体化全尺寸AI生成,覆盖超过196个国家和地区。模型输入一张卫星图像或一段文字描述,可在消费级GPU上用10分钟生成公里级3DGS城市场景,效率比传统模式提升1000倍。体验官网已上线,相关能力已应用于飞行街景2.0,用户可操控摇杆漫游3D场景。
大晓机器人联合南洋理工大学 S-Lab、上海人工智能实验室发布人–场景交互重建研究 HSImul3R,已被 ECCV 2026 接收。
蚂蚁灵波发布LingBot-World 2.0轻量版,参数规模1.3B,面向消费级单卡GPU设计,可在本地实现实时世界生成。该版本延续7月开源的14B主模型路线,先训练Causal World因果预训练底座,再经一致性蒸馏与DMD蒸馏压缩去噪步数,并让Student在自身长时self-rollout轨迹上训练以减少累计漂移。
安努智能一周内发布六款模型,包括实时长视频生成模型Helios、软物体仿真平台SimLab、世界模型ActiWorld、强化学习工具EvoHIL、工业垂类模型AnuVerse-0.5和端到端部署系统Nexus,覆盖数据生成、认知理解、训练进化、动作执行到端到端部署环节。
脸谱心智于 2026 年 6 月发布技术报告《Looped World Models》(arXiv: 2606.18208),提出 LoopWM,称其为首个将循环 Transformer 架构用于世界建模的方法,论文登上 Hugging Face Papers 当日 Top 1。
PlannerForge 是一个 LLM-agent 框架,把自动驾驶场景测试的场景生成、检索、修改、ADS 执行与结果分析统一到同一流程,并新增 ADS Enhancement 与 ADS Benchmarking 两个阶段。
推荐理由:论文把场景生成到评估串成统一 LLM-agent 流程,并给出开源模型与商业 API 的对比数据。
京东在JDD大会上发布实时可交互世界模型JoyAI-Echo WM,在WBench Navigation评测中以81.6分排名第一。京东云已与摩尔线程等打造国产万卡集群并规划建设十万卡集群,同时推进1000万小时具身数据采集,首批开源数据集EgoLive已对外开放。京东还启动物理AI加速计划,计划5年内采购300万台机器人、100万台无人车及10万架无人机。
Hugging Face 博客介绍如何用 AsyncGRPOTrainer 的 LoRA 适配器同步,在 HF Jobs 上把训练与 vLLM 推理拆到不同机器,通过挂载 Storage Bucket 传递几 MB 的 rank-1 适配器,无需 NCCL。
推荐理由:原文给出跨机异步 GRPO 训练的可复用工程方案与五轮调优数据,读者可据此判断瓶颈定位与提速路径。
Hugging Face 上出现 quangnd58/evo1-so101-multitask,这是基于 OpenGVLab/InternVL3-1B 视觉语言主干、在 hungho77/so101-multitask 数据集上训练的 Evo-1 第二阶段检查点,用于 SO-101 机械臂的 3 项任务。