跳到正文

#具身智能

今日 15 条
7月6日周一
  1. qbitai38

    智平方在联合国开源类脑大模型 NeuroVLA 与 AlphaBrain Platform

    智平方科技在联合国开源周展示全球首个原创类脑大模型 NeuroVLA 及一站式开源平台 AlphaBrain Platform,其海外与生态副总裁 Kristine Mo 与图灵奖得主杨立昆同台交流。NeuroVLA 借鉴人脑“皮层—小脑—脊髓”三层协同机制,以更少数据完成学习与决策,使机器人运动抖动降低 75% 以上,脊髓层平均功耗低至 0.4 瓦。

7月5日周日
  1. qbitai78

    英伟达 GEAR 联合李飞飞团队发布 Real2Sim 系统 SimFoundry

    英伟达 GEAR 联合李飞飞团队、佐治亚理工大学等机构发布 Real2Sim 系统 SimFoundry,只需一段真实世界 RGB 视频即可自动生成可交互、可训练、可评测的机器人仿真环境。

    推荐理由:英伟达 GEAR 与李飞飞团队等提出 Real2Sim 系统,用一段视频自动扩展仿真训练数据,读者可了解其闭环思路与实验结论。

7月4日周六
  1. IEEE Spectrum robotics38

    中国机器人军团崛起,日本重新思考机器人未来

    东京 Humanoids Summit 上约 40 台机器人中,中国系统数量约为日本的三倍,部分日本企业还在自家技术演示中使用中国机器人。宇树 G1 在日展示,GMO AI & Robotics 与日本航空在羽田机场用其装卸货物集装箱,属试验项目。日本机器人密度排名从 1994–2009 年的全球第一降至 2024 年第五,当年韩国以 1,220 台居首、日本为 446 台。

  2. qbitai42

    光象科技完成数亿元天使轮融资,发布工业级具身机器人 Phi-Bot X1

    光象科技宣布累计完成数亿元天使轮融资,资金将投入物理原生基座模型研发迭代并推进具身智能机器人商业化交付。公司同期发布工业级自进化具身智能机器人 Phi-Bot X1,在汽车产线焊接上料真实工位完成验证,2026 ATC 展会连续三天运行 21.5 小时零失误,双孔对准动态操作精度达毫米级、角度控制在 0.3° 以内,连续工作成功率 100%。

7月3日周五
7月2日周四
  1. qbitai22

    科大讯飞智能交互生态发布会:AIUI、多语种交互、机器人超脑三大平台同步升级

    7月2日,2026科大讯飞智能交互生态发布会在深圳举行,AIUI从语音交互向多模态AI交互平台演进,融合图像理解与生成能力。多语种交互平台覆盖40余种语言,一站式赋能智能硬件出海;机器人超脑平台完成新一轮升级,强化多模态感知、复杂任务理解与场景执行能力,加速机器人从实验室走向真实产业。

  2. qbitai42

    Aether AI 完成 2000 万美元种子轮融资,押注因果世界模型路线

    Aether AI 宣布完成 2000 万美元种子轮融资,由经纬创投领投,走不做视频生成、3D 重建和 JEPA 的因果世界模型路线。其内部数据显示,在机器人操作任务上,因果世界模型相比传统世界模型成功率提升 25%-50%,样本效率提升 5 到 10 倍,部分案例仅用 50 条高质量数据即可让频繁失败的任务达到可靠成功率。

7月1日周三
  1. qbitai78

    英伟达开源机器人技能库 ASPIRE,Jim Fan 称代表全新持续学习范式

    英伟达开源机器人技能库 ASPIRE(Agentic Skill Programming through Iterative Robot Exploration),让机器人用代码执行任务、失败后看多模态执行轨迹再修程序,把验证过的修复经验沉淀进不断扩展的 skills library。

    推荐理由:英伟达开源机器人技能库 ASPIRE,把失败修复经验沉淀为可复用 Skill,读者可了解 Code as Policy 的持续学习思路。

  2. BAIR12

    BAIR 2026 届博士毕业生展示:机器人、LLM 与 AI 安全研究方向

    伯克利人工智能研究实验室(BAIR)展示 2026 届博士毕业生,研究方向覆盖机器人、具身智能、大语言模型与推理、计算机视觉、生成建模、AI 安全、人机交互及 AI for science 与医疗。毕业生将赴高校教职、博士后、产业研究实验室及自创初创公司,部分人仍在探索下一步。

  3. qbitai58

    群核科技三篇论文入选 ECCV 2026,联合英伟达等提出物理AI仿真平台 SPEAR

    群核科技三篇论文入选 ECCV 2026,涵盖空间感知与推理、强化学习数据生成、高保真物理仿真。其中联合 Adobe、NVIDIA、Apple、Intel 等提出的 SPEAR 仿真平台开放超 14000 个原生 Python 接口,可输出深度图、表面法线、实例分割等物理属性数据,并接入 InteriorAgent、InteriorGS 等结构化三维数据集。

  4. qbitai60

    Om AI联汇发布VLX端侧流式多模态模型系列

    Om AI联汇发布面向物理世界的端侧流式多模态模型系列VLX,提出流式多模态架构,以流式编码与缓存增量推理实现毫秒级实时感知。VLX由三款模型构成,VLX-Flow负责持续感知,VLX-Seek将坐标生成转化为区域检索实现定位,VLX-Go将视觉理解转化为机器人可执行的短时航点与运动轨迹。该系列覆盖0.6B至10B规格,单路延迟最低0.06秒,在端侧打通持续感知、精准定位到行动决策的闭环。

6月29日周一
6月15日周一
6月9日周二
  1. DeepMind blog30

    Google DeepMind 启动欧洲机器人加速器,15 家初创入选

    Google DeepMind 推出为期三个月的机器人加速器项目,从欧洲选出 15 家早期机器人初创公司,提供技术指导、产品辅导及 Gemini 机器人模型等 AI 资源支持。入选企业覆盖物流、制造、医疗、气候与导航等领域,包括开发机器人焊接平台的 3D-Components、做自主水下机器人的 Bubble Robotics、研发神经外科微机器人的 ROBEAUTE 等。

6月8日周一
6月3日周三
  1. NVIDIA blog robotics74

    NVIDIA Research 在 CVPR 发布 GraspGen-X、LCDrive 与 NitroGen 三项研究

    NVIDIA Research 在 CVPR 展示三篇论文:首个零样本抓取基础模型 GraspGen-X 基于 20 亿次仿真抓取训练,可为未见过的夹爪和物体生成抓取位姿。

    推荐理由:三篇论文分别覆盖零样本抓取、自动驾驶推理加速与虚拟环境智能体训练,可了解规模化训练如何提升跨场景泛化。

6月2日周二
6月1日周一
  1. NVIDIA blog robotics60

    NVIDIA 发布 Factory Operations Blueprint(FOX)工厂 AI 蓝图

    NVIDIA 在 GTC Taipei 上发布 Factory Operations Blueprint(FOX),一套用于构建自主工厂管理智能体的参考设计,可连接机器信号、质量系统与机器人集群,并编排质检、物料运输与工人安全等专用智能体。

    推荐理由:NVIDIA 公布工厂运营蓝图 FOX 的参考设计与首批落地案例,可了解工厂管理智能体的构建方式与部署路径。

  2. NVIDIA dev blog robotics62

    NVIDIA 发布物理 AI 基础模型 Cosmos 3

    NVIDIA 发布面向物理 AI 的前沿基础模型 Cosmos 3,结合物理推理能力。该模型面向机器人、自动驾驶和智能空间,用于理解现实世界、预测后续变化并生成针对特定环境、本体和任务的动作。

    推荐理由:NVIDIA 发布面向物理 AI 的前沿基础模型 Cosmos 3,读者可了解其推理、世界与动作模型的定位。

5月27日周三
  1. Robohub60

    康奈尔大学研发软体夹爪,靠触觉判断草莓成熟度并轻柔采摘

    康奈尔大学研究团队用可拉伸光纤传感器制作软体机器人夹爪,通过触觉预测草莓成熟度,并轻柔地将果实从藤蔓上旋拧摘下而不造成损伤。夹爪装有两种光纤传感器,分别测量手指弯曲度和指尖压力,据此估计物体形状并调整抓握力度;腕部还加入行星齿轮机构,使夹爪旋转拧下果实而非拉扯。

5月20日周三
5月18日周一
4月13日周一
  1. DeepMind blog78

    DeepMind 发布 Gemini Robotics-ER 1.6,增强空间推理与仪表读数能力

    DeepMind 发布 Gemini Robotics-ER 1.6,这是其面向机器人推理的模型升级版,增强了空间推理、多视角理解和成功检测能力,并新增仪表读数功能,可读取压力表、液位计等工业仪表。

    推荐理由:Gemini Robotics-ER 1.6 在指向、计数、成功检测和仪表读数上的能力变化,以及通过 API 和 AI Studio 开放使用,可供开发者评估其作为机器人高层推理模型的适用性。

3月17日周二
1月9日周五
  1. NVIDIA dev blog robotics62

    NVIDIA 用仿真到真实工作流构建 Isaac GR00T N1.6 通用人形能力

    NVIDIA 发布 Isaac GR00T N1.6,用于构建人形机器人的通用能力,覆盖感知、规划与全身控制。该工作流将仿真、控制与学习统一起来,让机器人在进入真实世界前先习得复杂技能。

    推荐理由:NVIDIA 官方给出 GR00T N1.6 的仿真到真实工作流,读者可了解人形机器人通用能力训练如何统一仿真、控制与学习。