智元官网合伙人名单移除首席科学家罗剑岚
量子位发现智元机器人官网合伙人团队名单中已不见原首席科学家罗剑岚,其个人主页和X简介也不再保留智元职务,截至发稿智元与本人均未公开宣布。罗剑岚2025年4月加盟智元出任首席科学家并牵头组建智元具身智能研究中心,后升任合伙人、高级副总裁兼首席科学家,任职约1年4个月。
量子位发现智元机器人官网合伙人团队名单中已不见原首席科学家罗剑岚,其个人主页和X简介也不再保留智元职务,截至发稿智元与本人均未公开宣布。罗剑岚2025年4月加盟智元出任首席科学家并牵头组建智元具身智能研究中心,后升任合伙人、高级副总裁兼首席科学家,任职约1年4个月。
黎曼动力联合光轮智能和诺亦腾机器人共建具身智能数据底座,把采集、仿真、训练和评测接成一条线,并计划到2026年底完成100万小时机器人训练数据采集。黎曼动力此前用23.2万小时数据训练出Riemann-1.0,其前身为昆仑万维内部Matrix世界模型团队。三方还将共建数据规范、标注标准和评测基准,部分具身训练数据面向社区开源。
宇树科技8月6日公布科创板上市战略配售结果,9家投资者参与,DeepSeek母公司杭州深度求索获配93.339万股,占本次发行总量2.31%,按150.80元/股发行价计算认购金额约1.41亿元,锁定期36个月。
NVIDIA 发布 Cosmos 3 开放物理 AI 世界基础模型家族,基于 mixture-of-transformers 架构,同时支持视觉推理、世界生成与动作预测。
推荐理由:Cosmos 3 以开放权重和三种规模覆盖世界生成与动作预测,读者可据此判断物理 AI 团队如何做后训练与部署。
ROBOTIS 团队开源模块化框架 CYCLO,将 Physical AI 工作流中的数据、训练、仿真与硬件控制整合到单一流程。
ROS 物理 AI 特别兴趣小组将于 8 月 7 日举办会议,邀请 Encord 分享其工作如何与该 SIG 的工作相连接。会议时间为 2026-08-07T15:00:00Z,详情可在 ROS 治理页面文档中嵌入的 Google 日历上查看。
Ego2Robot 提出一条可扩展流程,通过动作重定向、机械臂视觉合成和多级质量筛选,把第一视角人类操作视频转换为机器人训练数据,支持精选数据集与野外视频,产出 18,561 小时数据、覆盖 15 种机器人形态。
推荐理由:论文给出将第一视角人类视频转为机器人训练数据的可扩展流程,并公开数据规模与泛化评测设置。
BridgeVLA++ 在 BridgeVLA 基础上加入统一时空记忆架构,可对观测历史进行推理,同时保留原框架的数据效率与泛化能力。该框架在两个记忆依赖型操作基准上取得 state-of-the-art 表现,并在双臂操作设置和另一个真实机器人平台上完成验证。项目主页为 https://bridgevla-plus.github.io/。
推荐理由:BridgeVLA++ 在原有数据效率基础上加入时空记忆,读者可了解记忆增强 VLA 在 3D 操作任务上的设计思路与验证范围。
优诺智行(UnoMove)在苏州招聘四类机器人岗位:控制与导航算法、边缘侧大模型与3D场景理解、机器人应用全栈、电气与传感器工程师。其核心产品 UnoBox 为边缘计算盒子,提供感知-决策-控制全栈能力,代码跑在 Jetson 上,算法在 Isaac Sim 中训练,最终交付物流堆场、巡检机器人和农机等真实场景。
GROVE 是一个免训练框架,用单一因果增长的记忆统一反应式视频问答与主动辅助,支持多尺度检索。它把细粒度感知证据逐步整合为带时间戳的时刻、连贯片段和跨天重复模式,每层配对应的检索技能。在 MM-lifelong 和 EgoServe 等基准上,GROVE 取得所比较方法中的最佳结果,消融显示各时间层与访问技能互补,跨多天证据时模式层收益最大。代码将发布于 GitHub。
推荐理由:GROVE 用单一因果增长记忆统一视频问答与主动辅助,读者可了解其分层记忆与检索设计。
TechCrunch 与 Hudson Labs 分析特斯拉 2019 年以来财报电话会记录发现,马斯克如今近 50% 的发言时间用于谈论 AI、robotaxi 和 FSD,2022 年这一比例仅为 15% 至 20%。
美国联邦通信委员会 7 月 28 日将重量超过 2 公斤的移动通信机器人及太阳能逆变器加入“受限清单”,来自任何国家的新产品不再具备进口资格,已认证设备不受影响。
杭州联汇科技(Om AI联汇)宣布完成新一轮数亿元融资,由前海母基金加码领投,杭州政府产业基金与多方资本协同参投。公司同时开源VLX-Seek 1.5端侧原生细粒度感知多模态模型,其3B参数版本多项核心指标超越英伟达LocateAnything-3B,无人机具身场景准确率提升62.9%,目标误报率降低74.8%。募集资金将用于VLX模型系列技术迭代及加速物理AI场景商业化落地。
作者开源了自主搭建的低成本 AUV 项目 OpenMantaClaus,在 SAUVC 比赛中获得第二名。整机自主栈运行在 Raspberry Pi、Blue Robotics Navigator 飞控和单个 USB 摄像头上,软件基于 ROS 2,并扩展了 ROS 2 BlueOS Extension 以在 BlueOS 内运行容器化环境。
EPFL、杜克大学和里斯本高等技术学院团队在 Science Robotics 发表研究,用物理仿真 simZFish 和 80 厘米、2.7 公斤的机器鱼 ZBot 复现斑马鱼视觉运动反应(OMR)神经回路。
具身智能行业估值逻辑正从为 Demo 可能性付费转向为生产力付费,投资人开始追问机器人每天干几小时活、客户是否续约。上海交通大学杨学以酷哇科技首席科学家身份提出,世界模型分两层,第二层理解并遵守人类社会规则才是最大机会,验证场所只有真实部署现场。酷哇已积累 50PB 城市运行数据、万台级真机部署于全球 50+ 城市及地区,并自研通用具身大模型 COOWAM。
World Labs于7月21日宣布收购机器人仿真公司SceniX,一周后双方公布Real-to-Sim-to-Real(R2S2R)最新成果,将真实机器人任务搬进仿真、在放大的任务场景中训练和评测策略,再部署回真机,并检验仿真中的相对表现能否预测真机表现。
黄仁勋在Y Combinator访谈中称Agent是一种新的软件形态,不必达到100%准确才有价值,可控性可能是其下一阶段最大突破口。他表示AI消灭的是任务而非工作,编码正被自动化但软件工程师岗位同比增长约10%,并称物理AI开启新增长曲线,机器人将撑起英伟达下一个千亿美元市场。
IEEE Spectrum 的 Video Friday 合集展示了多款机器人视频:Google DeepMind 的 Gemini Robotics 2 作为智能层实现全身控制、灵巧操作与多机器人协作;Hello Robot 推出可在家中安全导航的单臂三轮机器人 Stretch 4.0;南加州大学与 NASA 等合作训练机器狗用于火星、月球等行星探索。
香港大学 Taku Komura 团队 2016 年发表的《A Deep Learning Framework for Character Motion Synthesis and Editing》获 SIGGRAPH 时间检验奖,该工作首次用深度学习从大规模动作捕捉数据中学习可复用的运动表示。
DeepMind 发布 Gemini Robotics ER 2 具身推理模型,作为机器人的高层大脑负责对话、理解物理世界并规划多步任务,再把动作执行交给底层 VLA 模型。
推荐理由:官方给出进度分类、时刻定位与多机协作的量化结果,可据此判断高层推理模型与底层 VLA 的分工方式。
西湖大学团队孵化的西湖风形科技已完成第一代M500空中操作机器人并实现小批量交付,该平台基于“一体三脑”系统,更换标准化末端工具即可完成接触式抓取、剪切、清洁等作业。其空中近距离“叠飞”系统曾在13.18米/秒气流干扰下实现亚厘米级空中对接与工具交换,相关成果于2025年9月发表于《Nature》。
香港运输署7月23日批准百度萝卜快跑在机场岛开展车内无安全员的全无人测试,7月27日正式启动,为全球右舵市场首次全无人自动驾驶公开道路测试。萝卜快跑随后宣布携手Uber和Lyft旗下Freenow在伦敦启动公开道路测试,首期落地布伦特行政区,预计2027年起面向市民提供无人驾驶出行服务,成为目前唯一明确进入伦敦Robotaxi测试体系的中国企业。
NVIDIA 展示 Jetson 边缘 AI 与机器人平台,Jetson Orin Nano Super 提供 67 TOPS 算力,可本地运行 Reachy Mini 语音视觉助手等首个机器人项目。
伦敦玛丽女王大学等欧洲团队研发了一种机器人指尖,其合成皮肤通过布拉格反射器在受力变形时反射不同波长光,由内置摄像头读取颜色变化,生成拓扑、应变和接触压力图。该指尖实现100微米分辨率且无计算延迟,已用于生成人类指尖、硬币和叶片的形貌图。研究者称下一步希望提升对非平面物体的感知能力,并已与潜在应用企业接触。
DeepMind 发布 Gemini Robotics 2,包含 VLA 模型 Gemini Robotics 2、具身推理模型 Gemini Robotics ER 2 和端侧 VLA 模型 Gemini Robotics On-Device 2。
推荐理由:DeepMind 发布三款机器人模型,覆盖全身控制、灵巧操作与端侧部署,可了解 VLA 与具身推理的分工。
智在无界(BeingBeyond)发布 Being-H0.8,称其为首个基于人类视频数据的隐式触觉世界动作模型,在 Being-H0.7 基础上首次把触觉模态纳入隐空间表示。
论文《Data Pyramid for Embodied Manipulation》将具身机器人学习数据组织为五类互补来源的金字塔,包括真实机器人数据、UMI 风格数据、第一人称与第三人称视角数据、仿真数据和通用视觉语言数据。
推荐理由:论文把具身数据来源整理成五层金字塔,并梳理各类数据配方与基础模型能力之间的对应关系。
以色列研究实验室 Enigma 完成 7100 万美元种子轮融资,由 Index Ventures 和 Ribbit Capital 领投,Conviction Partners 的 Sarah Guo 参投。
超维动力与北大医疗达成合作,围绕具身智能在医疗场景中的数据采集、世界模型与仿真训练展开联合创新,构建从拟真训练到场景验证再到医院应用的落地路径。超维动力提供KAI World Model世界模型引擎、KAI Halo第一人称数据采集头环及KAI Embodied AI Infra等技术底座,北大医疗提供临床场景与医疗经验。
Encord 在加州 San Leandro 仓库试验用 Zander Labs 的脑电波头显采集机器人训练数据,通过测量错误、意图和惊讶等心理状态为数据集打标签。
上海新智具身智能(NeoteAI)联合复旦大学可信具身智能研究院发布 N0 系列三份技术报告,数据与模型均开源。
推荐理由:三份报告分别给出触觉数据底座、VLA 触觉预判和世界模型触觉预测,可对照看触觉如何接入现有技术路线。
RSS 2026 上,Physical Intelligence 相关研究者称包括 PI 在内的北美头部具身智能公司离成熟都还有不短距离,整个领域尚未出现奠基性工作,并质疑中国公司自称"中国版XX"。多位研究者认为 VLA 与世界模型并不冲突,π0.7 已含世界模型组件;数据筛选与配比(curation)比单纯堆量更关键,Simar Kareer 建议参照 π0 的 1 万小时训练规模。
科沃斯将旗下具身智能机器人八界整体开源,并在苏州挂牌成立八界开源智创空间,面向开发者、高校师生和科研人员免费开放平台使用权限。八界采用六自由度机械臂、臂展800毫米、静音移动底盘与44厘米升降机身,搭载两颗双RK3588融合SoC,可在本地带动7B参数大模型。
IEEE Spectrum 的 Video Friday 汇总了本周机器人视频:Generative Bionics 用六个月把 GENE.01 做成可行走、可感知和交互的人形平台,其全身多模态皮肤可感知触觉、接近、力与温度。Generalist 的具身基础模型 GEN-1 支持从五指手到专用工具的多种末端执行器,通过跨数千种接口的预训练获得可迁移的物理常识。
量子位不完全统计97家国内具身数据玩家,其中70家做数据采集、27家做数据infra,过去一年15家独立具身数据服务商共完成34起融资、合计约44.7亿元。行业现有年产能为160万至180万小时加7000万至8000万条,短期目标为未来1至3年产出2500万至3500万小时加亿条级数据。玩家中独立数据服务商39家占40%,为最大群体,但15家中13家最新轮次在A轮及以前,没有一家披露过利润。
7月19日WAIC“世界模型六小龙”论坛上,大晓机器人、蚂蚁灵波、极佳视界、无界动力、智元机器人、自变量机器人六家技术负责人就技术路线展开讨论,形成像素生成、隐空间(JEPA)与融合三派。
梅卡曼德机器人在 WAIC 2026 展示同一套“眼脑手”组件驱动的人形机器人与机械臂作业,覆盖工件上下料、料筐搬运、线束插头柔性抓取与精密装配、五角螺母抓取,以及零售和家庭场景中的物体分类与透明物体分拣。
佐治亚理工助理教授Danfei Xu发起第一视角人类操作数据生态EgoVerse,公开版本含1362小时人类演示数据、约8万个episode、1965项任务、240个场景和2087名采集者,联盟伙伴包括佐治亚理工、斯坦福、苏黎世联邦理工、UC San Diego以及Meta、Scale AI、光轮智能等公司。
北京市发展改革委会同市委网信办、市科委中关村管委会、市经济和信息化局联合印发《北京市关于加快智能体引领发展的若干措施》,提出九项具体举措。政策聚焦基础模型能力、智能体底层共性技术、原生应用与标杆场景、智能终端融合、OPC创新创业模式、Token经济、安全治理、要素保障和开源开放等关键领域,并探索智能体分级分类监管、Token券与智能体服务券等支持方式。