中国车企追随特斯拉押注人形机器人
TechCrunch 报道称,中国多家车企正追随特斯拉押注人形机器人。小鹏机器人部门本周融资超 9 亿美元,投后估值超 63 亿美元,由 IDG 资本领投,腾讯、阿里等参投,公司称这是中国具身智能行业最大单轮私募融资。奇瑞旗下 AiMOGA 据报已启动 IPO 准备,比亚迪发布人形机器人“小迪”,长安、广汽、理想、上汽、赛力斯等也在研发人形机器人。
TechCrunch 报道称,中国多家车企正追随特斯拉押注人形机器人。小鹏机器人部门本周融资超 9 亿美元,投后估值超 63 亿美元,由 IDG 资本领投,腾讯、阿里等参投,公司称这是中国具身智能行业最大单轮私募融资。奇瑞旗下 AiMOGA 据报已启动 IPO 准备,比亚迪发布人形机器人“小迪”,长安、广汽、理想、上汽、赛力斯等也在研发人形机器人。
《时代》周刊公布 2026 年度全球百名 AI 人物名单,智元机器人创始人、董事长兼 CEO 邓泰华入选“创新者”类别。时代周刊提到,智元去年出货 5100 台机器人,并于今年 4 月推出视觉-语言-动作模型 GO-2,公司称该模型缩小了“语义-执行差距”。邓泰华表示,目标是让机器人技术在制造业、物流业、零售业和酒店业等领域实现可靠、可重复的应用。
RoboCup 2026 首次举行 11 对 11 人形机器人足球赛,由德国不来梅的 B-Human 对阵莱比锡的 HTWK Robots,两队均使用 Booster Robotics 设计的机器人。RoboCup 联合会在 1997 年提出到 2050 年组建可战胜人类世界杯冠军的自主机器人球队,联合会主席 Ubbo Visser 称这场比赛显示人形机器人硬件与 AI 智能带来的新水平。
Anthropic 发布模型硬件标准 MHS,把不同厂商硬件的控制方式转译成 Agent 可发现、可读取、可调用的一致接口,被称作物理世界的 MCP。接入后 Claude 可直接控制 Hugging Face LeRobot 生态中的低成本 SO-ARM101 机械臂,自行测量工作区、完成校准,再通过 MHS 调用底层控制器执行动作,无需提前训练策略或遥操作。
量子位刊载的触觉传感技术路线分析首篇认为,视触觉传感器(VBTS)底层仍依赖小体积CMOS摄像头模组成像,算法多复用ResNet/CNN、U-Net、光流法等视觉工具,硬件门槛低、同质化严重,难以形成技术护城河。
8月28日,阿里巴巴集团旗下高德发布首个无长程依赖的万帧级流式3D重建模型ABot-Recon,仅凭连续12帧局部画面即可实时重建上万帧3D场景,在KITTI、Oxford Spires、VBR等评测中取得最低误差的SOTA。
UrbanGround 是一个基于香港全域三维地理数据构建的真实尺度城市副本沙盒,用于测试多模态大语言模型智能体能否在闭环第一人称视角下完成可靠导航与空间推理。
推荐理由:UrbanGround 用香港全域三维数据搭建可闭环交互的城市沙盒,读者可了解 MLLM 智能体在长程城市导航中的能力边界。
Zero-WAM 提出一种因果视频-动作模型,通过上下文人类视频引导执行训练中未见的操作任务。作者用自动流程将任务采样的机器人轨迹转换为语义匹配的人类视频,构建 HumanGen 数据集,包含 8.6K 个任务、74.2K 对人类-机器人上下文学习配对,并提出上下文未来片段预测(IFP)目标以抑制已见任务的捷径。
推荐理由:论文给出以人类视频作为上下文任务说明的跨任务泛化方案,并公开数据集与仿真对比结果。
Hugging Face 发布开源鸭子机器人 Microduck,售价 399 美元,圣诞节前发货。这款高 25 厘米的机器人能摇摆行走、用喙叼取物品、跌倒后自行站起、蹲下甚至滑旱冰,通过摄像头、激光雷达和两个 IMU 感知环境。Pollen Robotics 表示其行为可在仿真中训练并直接部署到机器人上,SDK、仿真和完整强化学习训练栈已在 GitHub 开放。
由两位前 Meta FAIR 研究科学家创办的 Perceptron 本周发布视觉模型 Isaac 0.5,面向仓库、工厂等工业场景,帮助视觉引导机器人感知、推理与行动,并从机器人拍摄的视频中提取视觉信息。
为机器人构建 AI 大脑的开发者正试图复刻前沿 AI 实验室的路径,靠更多样数据集、不同训练方案和强化学习场景突破物理 AI 的“GPT-2 时代”。Foxglove 在 Actuate 大会上发布基于 Nvidia Cosmos 开放权重世界模型的新产品,支持用自然语言查询数据以加速评估与仿真。
北美具身初创 Skild AI 发布机器人基础模型 S1,主打上下文学习,无需后训练或微调,只看一段人类示范视频即可完成煎饼、冲泡咖啡、给植物换盆、设备组装等长程任务,上下文学习任务长度最长 10 分钟。
推荐理由:Skild AI 的 S1 把机器人上下文学习拉到 10 分钟长程任务,并给出与语言提示 VLA 的成功率对比数据。
一段10分钟一镜到底、无剪辑无遥操作的Demo显示,宇树G1与智元远征A3两款不同品牌机器人共用同一套模型,在15m²出租屋内协作完成擦玻璃、收纳、跨本体递围巾等长时序家务。模型支持任务随时打断后断点续做,宇树G1够不到第三层柜子时自主搬箱、用脚踢箱垫高,据称仅用几十小时视频数据训练。
超维动力在2026世界机器人大会现场展示全栈具身智能系统,包括全尺寸人形机器人KAI Bot、37自由度灵巧手KAI Hand、数采头环KAI Halo、KAI World Model与KAI Embodied AI Infra。
据两名知情人士消息,机器人初创公司 Generalist 在 8VC 领投的追加融资后估值达 30 亿美元,监管文件显示这笔新资金接近 2 亿美元。该资金是 6 月由 Radical Ventures 领投的 4 亿美元 B 轮的扩展,使该轮总融资额达到 6 亿美元。
Google DeepMind 发布白皮书《Visual General Intelligence》,探讨以视觉为中心、从图像、视频和几何等模态的学习中能否涌现出通向 AGI 的智能,并将其称为视觉通用智能(VGI)。白皮书由多位不同机构作者共同撰写,目标不是给出视觉智能的唯一定义,而是厘清 AGI 时代计算机视觉应追求的原则、视觉输入模态、基准、学习范式,以及视觉作为核心与语言等其他模态的关系。
范式举办 PhanthyMotus 生态社区共建计划发布会,宣布其首个通用具身 Agent 底座从开源迈入多方共建阶段,优必选、北京人形机器人创新中心、星动纪元等十余家本体厂商参与。
字节跳动已入股未来不远机器人最新一轮融资,该公司半年内完成三轮融资、累计超10亿元,投资方还包括汇川产投、国方创投、德宁资本、纳爱斯等。其机器人已进入全国500多个普通家庭商业化使用,并在WRC上由第二代全栈自研本体F2搭载新一代自进化WAM世界动作模型,完成7步肉酱意面端到端闭环烹饪。
原力灵机DM0.5在RoboDojo具身评测中以综合得分24.90、平均成功率19.34%登顶,Memory维度得分47.74,Cover Blocks任务三次随机测试成功率均为100%。
推荐理由:原力灵机DM0.5登顶RoboDojo并开源权重与训练框架,读者可了解其数据、架构与推理加速的具体做法。
Haofeng Chen 等人发表研究,用 3D 打印的柔性 TPU 层与导电织物贴片构成人工皮肤,通过电阻抗层析成像(EIT)重建触摸位置与力度。原型仅用 16 个电极就生成了较准确的压力分布图,硬件结构相对简单,主要难点在于 TPU 孔隙率表征与论文给出的 EIT 算法。
生数科技创始人朱军在 WRC 2026 分论坛发布团队最新研究成果,提出通用世界模型五级发展路线,从 L1 世界生成、L2 与世界交互、L3 在世界中行动,到 L4 自主世界智能体与 L5 世界组织者。
ResNet作者、蔚来高级副总裁及智驾负责人任少卿已成立物理AI基础模型和具身智能独立公司,蔚来明确战略投资并开展业务合作,公司已完成注册、估值达独角兽级别(超10亿美元量级),名称与融资细节未披露。任少卿仍在职蔚来,其技术底色来自蔚来世界模型NWM的研发与量产推送经验,他曾多次强调世界模型是自动驾驶与机器人共享的基础范式。
纽约初创公司 General Intuition 正以 60 亿美元投前估值洽谈新融资,投资方包括 Valor Equity Partners、Point72 Ventures 和 Seven Seven Six,Khosla Ventures 与 General Catalyst 等现有股东继续参与。
智象未来在 WRC 2026 发布原生全模态交互式世界模型 HiDream-O1-World,基于自研 UiT 架构,首次参评即登顶 WBench 的 Navi 分榜。该模型支持文本、图像及交互式操控输入,具备漫游、编辑、交互三项能力,核心突破是长时程时空一致性与物理一致性。
无界动力与韩国咖啡连锁 HOLLYS 在北京亦庄 WRC 现场开设联名咖啡店,由轮式半人形机器人服务员和机械臂咖啡师在开放人流中完成送餐、收杯、倒垃圾和手部消毒等连续任务,无预设轨迹。
量子位梳理发现,至少十六位香港高校教授以创始人、联合创始人或首席科学家身份参与具身智能创业,方向覆盖世界模型、具身大脑、触觉灵巧手、手术机器人、无人叉车、无人机与自动驾驶。港大马毅联合创立忆生科技做自主学习世界模型,港科大王煜联合创办的戴盟机器人每平方厘米排布4万个感知单元,港大罗平参与的超维动力做117自由度人形机器人。港中大(深圳)贾奎的具身智能引擎公司估值已达百亿并冲刺上市。
尹方鸣于2026年7月21日出任银河通用董事长,原董事长郭小亮退出。他2016年以200万元天使投资宇树换得15%股权,按发行价计算总收益约2.8亿元、回报超140倍。银河通用成立于2023年5月,累计融资超69.6亿元,估值超200亿元。
8月22日世界人形机器人运动会开幕式上,银河通用机器人参加机器人网球比赛,与网坛运动员同台竞技并由中央广播电视总台全球直播,完成正手、反手、发球、接发、底线调动、网前截击等动作,并在双打中与人类队友实时协作。
共生知行正在研发双足人形机器人的端到端感控一体化「大脑」基座模型,其Demo中机器人全自主驾驶卡丁车连续过弯,实现手眼脚同步协同与多接触点平衡力控。团队由96年出生的丁鹏翔带领,核心成员均为00后博士在读,公司成立刚满两个月,押注纯端到端路线取代分层架构。
8月23日,上纬新材旗下启元机器人正式开启启元Q1、启元T1双产品预订,用户可通过官方小程序、天猫、抖音、B站官方店铺及线下体验活动参与,预计首发发货时间为2026年9月。
无界动力在2026世界机器人大会上集中展示以隐空间世界模型为核心的具身通用大脑MWA™,并提出“隐空间世界模型+强化学习”技术路线。创始人张玉峰称世界模型价值在于推演行动如何改变世界,公司主张“用工业练技能、用商业练泛化”。CTO夏中谱认为具身智能仍处“诸子百家”早期阶段,产品解决方案总经理沈明达则提出工业产线自动化从G1到G5的五级进化。
优必选在 WRC 上1:1复刻客户真实产线,用近十台工业人形机器人 Cruzr S2 和 Cruzr Y1 连续演示汽车机加件与钣金件上下料、拆码垛和物流小件分拣,定位精度小于1mm,物流分拣平均抓取节拍接近1100件/小时。
魔法原子在8月19日至23日的WRC 2026上展示工业制造、物流分拣、公共安全三大场景解决方案,并首发轻工业四足机器狗MagicDog T1。T1整机重约18kg、持续负载最高15kg、最高速度5m/s,可攀爬18cm高度、应对40°坡道,空载续航最长约3小时,已在追觅智能制造工厂开展实际验证。
清华在读博士秦深涛创办的 OriginFlow(渊澈太初)提出 NeuroScale 技术体系,以非侵入式神经肌电为信号入口,融合第一视角视觉与 IMU,通过 PULSE 基座模型重建姿态、接触力与驱动力,并整理为可学习的 Human Tokens。
知跃空间智能发布全脑仿真基础平台 DeepSoma(知跃灵物),从树突、膜电位、离子通道等生物物理层面建模精细神经元,而非 Eon Systems 采用的 LIF 简化模型。
优必选在2026年WRC上1:1复刻客户工厂产线,用近十台工业人形机器人Cruzr S2和Cruzr Y1连续演示汽车机加件与钣金件上下料、搬运拆码垛和物流小件分拣,定位精度小于1mm,平均抓取节拍最高接近1100件/小时。
硅羽科技创始人张富(李泽湘学生、前大疆8年产业顾问、香港大学副教授)正把港大MaRS Lab的自主导航技术转化为产品,让飞行器不靠GPS和飞手遥控,自主感知、决策并完成任务。公司半年内连续完成四轮融资,累计数亿元,投资方包括耀途资本、锦秋基金、阿里巴巴。今年年底将量产第一阶段产品,面向地下管廊、隧道、仓储厂房、桥下与森林等场景,产品重量不到一千克、续航20-30分钟。
8月21日世界机器人大会期间,星海图举办“从模型到生产力”技术与产业应用论坛,首席科学家赵行介绍G0.5基础模型内嵌原生动作思维链,并预告G0.5 MAX即将发布,同时启动G0.5复现计划,开放模型权重、推理接口、评测基准与微调工具。
Hugging Face 论文页上线 EXIMO,一种用视觉语言模型(VLM)引导 VLA 策略探索的方法。页面目前仅开放论文讨论,未披露模型版本、任务本体、仿真或真机结果等细节。
IEEE Spectrum 的 Video Friday 汇总了多段机器人视频,其中包括宇树的高跳人形机器人,编辑质疑其商业用例尚不明确。Generalist 发布机器人基础模型 GEN-1.5,可在数秒内从单个示例学会新任务,无需梯度更新或微调,并展现零样本物理泛化能力。