Skild AI 用自我对弈训练人形机器人 Messinator 踢足球
Skild AI 在 NVIDIA Isaac Sim 虚拟足球场中让机器人自我对弈约 140 年,训练出人形机器人 Messinator,其大脑基于旗舰基础模型 S1,仅以进球为奖励,盘带、护球、抢断和倒地起身等行为由机器人自行习得。
Skild AI 在 NVIDIA Isaac Sim 虚拟足球场中让机器人自我对弈约 140 年,训练出人形机器人 Messinator,其大脑基于旗舰基础模型 S1,仅以进球为奖励,盘带、护球、抢断和倒地起身等行为由机器人自行习得。
前华为云大模型CTO李寅与前华为多模态首席科学家张含望联合创办息壤开物,连续完成数亿元种子轮及天使轮融资,估值达5亿美金,由敦鸿资产领投。公司要做Large Physics Model(LPM)大物理模型,先从海量视频、机器人轨迹和真实交互中预训练物理基础模型,再迁移到不同本体和任务。
觅蜂科技9月23日推出觅蜂派,以硬件加App加数据引擎的方式做具身数据众包采集,普通人申领MEgo采集设备后接单采数据并按有效时长获得报酬。觅蜂称MEgo系列已下线2万套,累计采集百万小时有效数据,覆盖22大类场景,内测一个月注册用户2万人、提交1.3万份采集任务。
2026云栖大会具身智能论坛上,行业判断数据时长正失去意义、模型增益才是数据的计价单位,竞争从"找数据"转向"造数据、管数据、用反馈继续生产数据"。阿里云以Qwen参与标注、HappyHorse生成增广数据、DataWorks编排流水线、PAI承接分布式训练,并披露平头哥真武810E芯片在具身智能赛道出货超万片。
IROS 2026 将于 9 月 27 日至 10 月 1 日在美国匹兹堡举行,议程包括全体会议、主旨演讲、研讨会、教程、论坛、竞赛和一场辩论。主旨演讲于 9 月 28 至 30 日进行,涵盖自主手术、软体机器人、灾害机器人、操作系统的前沿押注以及具身智能的 AlphaGo 与 ChatGPT 时刻等主题。
诺因(Knowin)9月24日发布面向通用具身智能的生成式学习架构 GLOW 技术报告,称人类演示一次后机器人即可跨物体、跨环境、跨任务复用,在开盒收纳、浇水、擦桌、调酒等任务中得到验证。
灵初智能在十万小时级数据基础上发布模型 Psi-R2.5,改进数据质量与人机数据对齐方法。它逆向使用世界模型 Psi-W0,从真实机器人数据生成对应人手操作数据,训练端到端转换器输出匹配的机器人图像和动作,并称转换数据已在真机回放和后训练两类测试中得到验证,部分复杂任务仍未直接完成。
清华大学与无问芯穹开源面向具身智能的云原生纳管平台 RLark,以自研具身设备运行时(embodied-runtime)和任务级跨集群网络互联技术为核心,将机器人、相机等设备与云端算力纳入统一资源体系。
它石智航在 2026“跨国企业上海行”推介会上分享了其具身智能规模化落地进展,已自主研发 AWE 具身智能基座大模型,并采集超百万小时高质量真实人类操作数据。公司还自研了 A 系列轮式机器人、T 系列双足机器人和 21 自由度准直驱 DexHand 灵巧手,正推进产线验证。目前其研发团队硕博占比超 80%,未来将扩大团队并加快布局生产基地。
IEEE RAS 的 Ellen H. Rumley 与 Allison Okamura 撰文梳理中国机器人路线图,指出第 15 个五年规划(2026-2030)将具身智能列为优先未来产业,并明确强调人形形态。
上纬新材董事长稚晖君(彭志辉)发布并开售两款个人机器人 Q1 和 T1,均 19999 元起。Q1 主打可创造,支持 3D 打印定制外壳、设计互动动作与性格音色。
亮源新创9月21日发布技术博客,披露Light-O1人类动作预训练规模从37.5亿扩展到1200亿token(最大约对应10万小时人类动作),在第一视角人类数据、公开机器人数据和自研人形机器人数据上适配后,动作预测误差、全身姿态误差和腕部位置误差均持续下降并呈幂律趋势,被其称为迁移缩放定律。
意大利技术研究院机器人学副主任 Barbara Mazzolai 在 Nature Machine Intelligence 7 月发表的宣言中提出“可持续机器人”研究方向,主张把可持续性作为机器人设计的核心,减少技术对自然的足迹。她此前受章鱼、植物根系和种子启发开发了多款仿生软体机器人,并长期推动将物理与化学传感器集成到机器人中以感知所处环境。
NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,新增对 ROS Lyrical 和 Ubuntu 24.04 的支持,并引入面向 AI agent 的 setup、manipulation 等可复用技能与 agent-ready 文档。
推荐理由:Isaac ROS 5.0 的 agentic 工作流与 ROS Lyrical、Ubuntu 24.04 支持,为开发者提供了从开发到 Jetson 部署的完整路径参考。
小米发布MiMo-V2.6-Pro和Flash,Pro为1.02万亿参数、420亿激活,在Artificial Analysis Intelligence Index上拿到46分,位列开源第一。
推荐理由:原文披露了MiMo-V2.6的RL训练成本、评测成绩与开源清单,读者可据此了解大规模强化学习训练的工程细节。
清华大学、无问芯穹、正行创新联合开源具身智能体基础设施 RPent,将通用大模型的任务规划、VLA 等专家模型的动作执行与记忆系统连接成闭环,在 LIBERO-PRO 基准达到 92.6% 任务成功率。
推荐理由:RPent 把大模型规划、VLA 执行与记忆机制串成闭环,并给出 LIBERO-Pro 成功率与 Flash Mode 延时数据,可据此判断分层智能体路线的工程取舍。
社区独立项目 CPM-jev 发布 v0.1-research-preview,这是基于 openbmb/MiniCPM5-2B-Base 的 LoRA 微调模型,新增决策头为候选动作打分并归一化为概率分布。
ETH Zurich 研究人员把一只商用机器人手改造成能用手指行走的装置,为其加装电池和 Raspberry Pi Zero 2 W,并开发神经网络控制软件。该手有 20 个关节、每指 4 个,网络根据先前动作、手部状态和当前目标迭代输出下一关节状态;训练先在仿真模型中进行强化学习,行走速度快于改造的四足运动模型。
百度智能云已为超过50家重点具身企业提供全栈AI云技术支撑,其百舸平台将SONIC模型训练配方集成上云后可一键扩展至128卡训练规模,WAM模型推理延迟降至优化前的四分之一。在东莞,由百度智能云承建运营的具身智能训练场规划13个真实产业场景、配置50台套异构本体,已服务35家具身智能企业。IDC报告显示百度智能云以29.55%市场份额位居中国具身智能云市场第一。
EPFL 的 Aude Billard 与 Mirko Kovač 等研究者提出新学科 Sustainability Robotics,主张机器人不应只按技术性能评估,还须纳入环境、社会与经济影响,并遵循最小侵入、普遍可及、共生三条原则。
针对 MiniMax-H3 这类全模态生成模型,一项新评测考察其物理世界推理能力,在 517 个评测实例中整体成功率为 41.97%。其中基于视频的决策推理成功率最高,为 56.00%,基于音频的消歧推理最弱,仅 27.40%。评测设计了隐式提示配多帧、音频-图像、前缀视频和音视频四类任务,要求模型跨模态整合互补信息以推断潜在事件状态与未来动态。
研究显示,针对视觉语言动作(VLA)模型的后门攻击 BadVLA 可在触发器出现时让机器人动作轨迹产生条件性偏移,无触发器时任务表现基本正常;GoBA 用咖啡杯等普通物体作触发器,报告 97% 攻击成功率且不降低干净输入上的表现。
英伟达 Inception 全球物理 AI 负责人 Les Karpas 将在 TechCrunch Disrupt 2026 的 Real World AI Stage 发表演讲,主题为机器人为何仍在等待自己的 ChatGPT 时刻、障碍何在。
紫东太初开源通用多模态大模型 ZDTaichu5.0-9B,在九项空间理解基准测试中八项位列 10B 档位第一,MindCube-tiny 得分 78.27,对照的 Gemma4 8B-E4B、Gemini 3 Pro、Grok 4 分别为 48.8462、70.87 和 63.56。
IEEE 已公开 2026 年 ICRA 的主旨演讲、全体会议、行业主题演讲、奖项演讲、教程及六场专题讨论的视频录像。本届 ICRA 于 6 月 1 日至 5 日在维也纳举行,全体演讲嘉宾包括 Ken Goldberg、Barbara Mazzolai 和 Roland Siegwart。
西门子数控(南京)生产基地引入银河通用人形机器人试工,在表面贴装产线搬运印刷电路板,该产线每月搬运总重量达18万公斤。西门子Xcelerator平台已聚集600多家生态伙伴、900多个解决方案和超66万注册用户,连接机器人厂商与真实工业场景。华沿机器人等伙伴借助平台上的工易魔方,以数字孪生和可视化拖拽完成产线场景构建与虚拟调试。
无问芯穹联合清华大学、上海交通大学开源具身智能端侧推理引擎 APXInf,支持 RTX 4090、Jetson Orin、Jetson Thor 等平台,首发支持 PI 0.5 与 WALL-OSS 两款具身模型。
智象未来(HiDream.ai)发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0(HD-V1),支持文本、图片、视频等多模态输入,可一键直出 5–20 秒 1080p 视频。
首届蚂蚁灵波具身大模型挑战赛在外滩大会启动,由蚂蚁灵波、魔搭社区和阿里云天池共同发起,以 2026 年 7 月开源的 LingBot-VLA 2.0 预训练模型为技术基座,面向全球开发者开放。大赛报名及线上初赛持续至 10 月 26 日,初赛设必做的 RoboTwin 2.0 仿真任务和可选真机创新任务,入围团队将于 11 月 13 日至 15 日在上海参加线下真机黑客马拉松。
生数科技发布世界模型 Motus2,在同一模型中整合行动、预测与评估三种能力,形成生成动作、预测后果、评估结果、更新策略的闭环,探索递归自我改进(RSI)。真机测试中,手机放置与多指操作两项任务基础策略平均成功率 65%,加入规划为 67.5%,加入基于模型的强化学习为 72.5%,两者结合达 75%;加入触觉后抽取纸杯与撕纸任务平均成功率从 60% 提升至 72.5%。
推荐理由:生数科技 Motus2 把动作生成、后果预测与价值评估放进同一世界模型,读者可了解其闭环自进化机制与真机数据。
2026崇礼论坛9月12日在崇礼·太舞小镇举行,以“未来此刻”为主题,参会嘉宾与观众超700人,由太舞小镇、甲子光年、破圈文化联合主办。论坛设置智能生活方式、Chongli AI Film Lab、AI Builders Show三个专场,并发布《2026AI生活方式白皮书》与2026「AI NEXT 20」榜单,同时启动首届崇礼AI短片节。
深度机智于 2026 年 9 月 9 日发布物理基座模型 PhysBrain 1.5,8B 版本在 28 项公开基准上取得 72.5 综合均分,位列参评开源模型首位,与 GPT-6 Astra(73.3)、Gemini 3.6 Flash(73.0)差距在 1 分以内。
亮源新创过去一个多月连续发布LightParkour、LightNav-0和Light REACT三项技术,分别面向复杂接触技能扩展、通用导航和全身韧性控制。
Mecka AI 正以约 5 亿美元估值完成红杉资本领投的新一轮融资,交易条款尚未最终确定。这家 2024 年成立的初创公司通过体感传感器和智能手机付费采集人们做咖啡、修车等日常任务的"自我中心"运动数据,用于训练人形机器人等机器人模型。此前三个月,它刚完成由 Framework Ventures 领投的 6000 万美元融资,并预计 2026 年底年化收入达 1 亿美元。
ETH Zurich 机器人系统实验室研究人形机器人猴杠穿越,机器人需跳上稀疏三维结构、通过稀疏横杆交互完成穿越并安全落地。宇树全面开源 UnifoLM-WLA-1.0 具身基础模型,称在多个基准上取得开源模型中的新 SOTA,单一模型可协调桌面与全身移动操作,支持跨任务和跨末端执行器泛化。
高德9月10日宣布扫街榜全面AI化,升级后的2026版用AI算法理解不同导航到店行为的评分权重。其空间智能核心引擎ABot-Earth 0.7被称为全球首个3D原生城市世界模型,仅需一张卫星图或一段文字,在消费级GPU上跑10分钟即可生成真实街景3D城市,效率比传统方法提升1000倍,已覆盖190多个国家、300多座城市。
研究者提出 SpatialBlock,通过合成积木堆叠任务提升大型视觉语言模型(LVLM)的 3D 空间推理能力。其构建的 SpatialBlock-15k 数据集包含 15,000 个积木堆叠问题,覆盖 3D 到 2D 投影、视角变换和结构组合,并加入受控颜色调制作为视觉线索。实验显示,用该数据集训练的 LVLM 在直接回答和基于推理的预测两种方式下均显著优于基线,并能泛化到真实世界空间任务。
IEEE Spectrum 报道,学术实验室与创业公司正竞相构建触觉数据集与使用技术,以突破精细操作瓶颈。
Mbodi 联合创始人 Xavier Chi 在 TechCrunch 播客 Build Mode 中表示,机器人不会迎来单一的 ChatGPT 式突破,人形形态也非必要。Mbodi 用自然语言让人教工业机器人新技能,并与 ABB Robotics 合作进入工厂和仓库,近期在八小时测试中取得 99.6% 成功率。
Mbodi 联合创始人 Xavier Chi 在 TechCrunch 播客 Build Mode 中介绍,其 AI 软件让人用自然语言教工业机器人新技能,并与 ABB Robotics 合作进入工厂和仓库。他透露 Mbodi 在八小时测试中达到 99.6% 成功率,并认为机器人不会出现单一的 ChatGPT 式突破,可靠性才是进入生产的关键。