Robot Talk 第163期:Hello Robot 的 Stretch 机器人如何帮助行动不便者
Robot Talk 第163期对话 Hello Robot 联合创始人兼 CEO Aaron Edsinger,讨论其 Stretch 机器人如何帮助行动不便者更独立地生活。Hello Robot 专注于开发实用、安全、易获取的机器人,Edsinger 此前曾创办四家协作机器人公司,并在 Google 担任机器人业务总监。
Robot Talk 第163期对话 Hello Robot 联合创始人兼 CEO Aaron Edsinger,讨论其 Stretch 机器人如何帮助行动不便者更独立地生活。Hello Robot 专注于开发实用、安全、易获取的机器人,Edsinger 此前曾创办四家协作机器人公司,并在 Google 担任机器人业务总监。
Google 旗下 AI 机器人团队 Intrinsic 宣布将平台部分能力开源,推出 Intrinsic Core,一套兼容 ROS 的机器人应用开发能力集。
MuJoCo 3.14.0 新增实验性接触模式 ipc 标志,用离散积分器实现无穿透柔性接触,每步求解带线性化接触约束的增量势能,位置更新经连续碰撞检测验证,目前仅支持 dim-2 flex 且接触无摩擦。
MuJoCo 3.13.0 发布,新增 discrete 积分器,将约束求解与隐式速度更新合并为一步,使被动弹簧和执行器位置增益在远超显式稳定极限的时间步下保持稳定。该版本还新增 Python 3.15(GIL 与自由线程)支持、站点几何关联网格、传感器 cutoff 属性,并移除 implicit/implicitfast 下 flex 有效度量的特例,相关模型需改用 discrete 积分器。
Google DeepMind 集中列出其模型阵容,包括新一代前沿智能 Gemini、实时音频模型 Gemini Audio、视频生成模型 Veo、图像生成与编辑模型 Nano Banana。
Google DeepMind 公布 Gemini 4 Argon,称其为下一代前沿智能。同期发布 Gemini 3.8 Live 与 Live Avatar、Gemini 3.8 Flash 及 3.8 Flash Cyber、Gemini 3.8 文本转语音,以及 AlphaGenome Atlas 和 WeatherNext 3 全球天气 AI 模型。
2025年9月从斯坦福回到清华的徐梦迪,成为清华姚班2026级四位新生班主任之一,并在迎新现场带来「构建下一代智能」主题分享。她本科毕业于清华车辆工程专业,2024年获CMU机械工程博士学位,博士论文《构建可适应的通用机器人》拿下CMU机械工程系最佳博士论文奖,主张通用机器人不能只靠Scaling,还需具备adaptation适应能力。
Google DeepMind 发布白皮书《Visual General Intelligence》,探讨以视觉为中心、从图像、视频和几何等模态的学习中能否涌现出通向 AGI 的智能,并将其称为视觉通用智能(VGI)。白皮书由多位不同机构作者共同撰写,目标不是给出视觉智能的唯一定义,而是厘清 AGI 时代计算机视觉应追求的原则、视觉输入模态、基准、学习范式,以及视觉作为核心与语言等其他模态的关系。
MuJoCo 3.12.0 发布,新增带真实位置与速度设定点输入的 pid 执行器,支持积分项、设定点速率限制与前馈输入,可替代 mujoco.pid 插件。dcmotor 控制器改为按 input 签名选择 pos、vel、ff、voltage 子集,增益从电压空间改为力矩空间,旧速度模式积分项被移除。
ROS 社区发布 8 月 3 日当周周报,ROSConJP 落幕,ROSCon Global 常规票价门票将于 8 月 24 日截止。本周开源项目包括低成本 ROS 2 水下机器人 OpenMantaClaus、用游戏学习 ROS 2 的 Robot System Quest,以及基于 cuRobo v0.8.0 的 GPU 加速运动规划封装 curobo_ros v2。
IEEE Spectrum 的 Video Friday 合集展示了多款机器人视频:Google DeepMind 的 Gemini Robotics 2 作为智能层实现全身控制、灵巧操作与多机器人协作;Hello Robot 推出可在家中安全导航的单臂三轮机器人 Stretch 4.0;南加州大学与 NASA 等合作训练机器狗用于火星、月球等行星探索。
DeepMind 发布 Gemini Robotics ER 2 具身推理模型,作为机器人的高层大脑负责对话、理解物理世界并规划多步任务,再把动作执行交给底层 VLA 模型。
推荐理由:官方给出进度分类、时刻定位与多机协作的量化结果,可据此判断高层推理模型与底层 VLA 的分工方式。
香港运输署7月23日批准百度萝卜快跑在机场岛开展车内无安全员的全无人测试,7月27日正式启动,为全球右舵市场首次全无人自动驾驶公开道路测试。萝卜快跑随后宣布携手Uber和Lyft旗下Freenow在伦敦启动公开道路测试,首期落地布伦特行政区,预计2027年起面向市民提供无人驾驶出行服务,成为目前唯一明确进入伦敦Robotaxi测试体系的中国企业。
DeepMind 发布 Gemini Robotics 2,包含 VLA 模型 Gemini Robotics 2、具身推理模型 Gemini Robotics ER 2 和端侧 VLA 模型 Gemini Robotics On-Device 2。
推荐理由:DeepMind 发布三款机器人模型,覆盖全身控制、灵巧操作与端侧部署,可了解 VLA 与具身推理的分工。
MuJoCo 3.11.0 为 geom 新增 surfacevel 表面速度场与 adhesion 接触粘附力,可用静态 geom 建模传送带、跑步机和转台,粘附接触支持"远距离粘附"以模拟磁铁。
佐治亚理工助理教授Danfei Xu发起第一视角人类操作数据生态EgoVerse,公开版本含1362小时人类演示数据、约8万个episode、1965项任务、240个场景和2087名采集者,联盟伙伴包括佐治亚理工、斯坦福、苏黎世联邦理工、UC San Diego以及Meta、Scale AI、光轮智能等公司。
Google DeepMind 推出为期三个月的机器人加速器项目,从欧洲选出 15 家早期机器人初创公司,提供技术指导、产品辅导及 Gemini 机器人模型等 AI 资源支持。入选企业覆盖物流、制造、医疗、气候与导航等领域,包括开发机器人焊接平台的 3D-Components、做自主水下机器人的 Bubble Robotics、研发神经外科微机器人的 ROBEAUTE 等。
Google DeepMind 在实验性原型 Project Genie 中上线 Street View 实景锚定能力,可基于美国地点影像生成可交互世界,并支持“Desert Sands”“Stone Age”“Ocean World”“B&W film”等风格。
DeepMind 发布 Gemini Robotics-ER 1.6,这是其面向机器人推理的模型升级版,增强了空间推理、多视角理解和成功检测能力,并新增仪表读数功能,可读取压力表、液位计等工业仪表。
推荐理由:Gemini Robotics-ER 1.6 在指向、计数、成功检测和仪表读数上的能力变化,以及通过 API 和 AI Studio 开放使用,可供开发者评估其作为机器人高层推理模型的适用性。
Open Robotics 公布 2025 年 Google Summer of Code 阵容,共 9 名学生参与 ROS、Gazebo、Open-RMF 等五个开源项目,规模为历年最大。