The Construct 推出 Humanoid Robotics Masterclass:亲手搭建人形机器人并远程操控 Unitree G1
The Construct 推出 Humanoid Robotics Masterclass,2026 年 9 月开课,学员将用课程包含的人形机器人套件完成机械装配、电子集成、ROS 2 配置与 AI 行为开发,最终做出自己的真人尺寸人形机器人。
The Construct 推出 Humanoid Robotics Masterclass,2026 年 9 月开课,学员将用课程包含的人形机器人套件完成机械装配、电子集成、ROS 2 配置与 AI 行为开发,最终做出自己的真人尺寸人形机器人。
科大讯飞新成立的安徽爻方智能联合中国科学技术大学、聆动通用机器人发布技术报告 iFLYTEK-Embodied-Omni,主张 VLA 不是终局,世界模型还需补上本体认知这一环。
利兹大学与加州大学圣地亚哥分校合作研发的 1.8 mm 软体生长机器人获 RoboSoft 最佳论文奖,该机器人通过磁控转向、无需内部气压即可生长,并能以最高 500 Hz 实时感知自身形状。其硅胶体内混入磁性颗粒并分区磁化,实现驱动与传感一体化,可同时生长和转向,有望减少微创手术中器械与组织的摩擦。
优艾智合研发的FabriVLA在Evo-SOTA榜单的Meta-World MT50基准中以90.0%的tier-average成功率登顶第一,超过包括π0在内的国际模型,参数规模为1B级。
它石智航在2026年WAIC首发具身原生基座模型AWE 3.5,并现场演示1:1还原的环形线束流水线,多台机器人集群协作、同一基础模型不切换参数完成装配、插接、收纳等任务。
日本北九州机器人初创公司 TriOrb 正在美国招聘创始级系统集成工程师,岗位融合解决方案架构师、现场应用工程师与系统集成工程师,负责全向 AMR 部署项目从需求定义到稳定运行的全流程。
Open-RMF 社区提议将跨楼层路径规划只规划到电梯大堂,而非直接指定具体电梯,待机器人抵达大堂后再根据实时可用性和等待时间分配最优电梯。讨论指出该方案会导致机器人无法提前呼叫电梯,建议在行进途中持续估算各电梯到达时间与机器人抵达时间,两者吻合时再呼叫。
Travis Kalanick 的机器人公司 Atoms 完成 17 亿美元融资,由 Andreessen Horowitz 领投,Ben Horowitz 将加入董事会,Bain Capital、Fifth Wall 和 Uber 参投。
开发者用数月时间构建了 Jointly,可自动完成 CAD 装配体转换、关节配置、机器人描述生成与初始调试,在 Gazebo 和 RViz 中自动生成经验证、可直接使用的机器人工作空间。技术部分已趋成熟,现寻求如何触达 ROS 2 开发者等目标用户,并询问开发者工具获取前 10 到 50 名用户的渠道经验。
Pavlov Mini Wheel 是一个基于 ROS2 的开源自主四足机器人平台,可借助计算机视觉检测目标物体并据此自主移动。系统采用 ROS2 Humble 负责通信与控制、Gazebo 用于仿真测试、树莓派 4B 做高层处理、Arduino Mega 做底层硬件控制,开发涵盖 URDF/Xacro 建模、仿真、硬件集成与 AI 感知。
OSRF 基础设施 PMC 下属 buildfarmers 团队公开发布 Buildfarmer Dashboard,集中展示 ROS 与 Gazebo CI 回归健康状态。该看板提供活跃测试回归、间歇性失败测试、可疑提交对比链接和已知问题分诊状态,此前这些信息需直接联系 buildfarmer 或翻查仓库 issue。这是首个公开版本,团队正征集可导航性、实用性及缺失上下文等反馈。
作者发布一款全自动 CAD 转 URDF 工具,支持 STEP、SolidWorks 装配体和 Onshape 装配体,生成模型包含推断关节、碰撞几何、惯量估计和完整仿真包。
NVIDIA 开源 Medical Physics Simulation 框架,作为 Isaac for Healthcare 内的 GPU 加速能力,用于建模解剖结构与器械交互、生成难以采集的场景并训练或评估机器人策略。
推荐理由:原文给出框架的仿真能力、开源入口与并行训练数据,读者可据此判断医疗机器人仿真工作流的复用方式。
都灵理工大学五人团队在ROS 2 Humble/Gazebo中复现并扩展了Yousuf & Kadri 2020年的ANN+FLS定位论文,用双EKF、在线训练ANN和模糊逻辑系统实现TurtleBot3 Burger的室内外无缝切换。
Fast DDS 发布 v3.2.5,修复 18 个 CVE,涉及反序列化、访问控制解析器等问题,均通过私下审查分支的压缩提交完成,无公开 PR。该版本还修复了 RTPSParticipantAttributes 内部数据竞争、on_xxx_matched 线程安全、DataWriterImpl qos 访问数据竞争等问题,并移除过期 TCP 通道。
量子位在 WAIC 2026 现场总结出十大趋势:Agent 成为约 70% 展商的默认话题,能否完成有效交付取代参数规模成为衡量大模型能力的标准。具身智能从动作演示转向真干活,灵初智能联合长飞切入光模块生产,方案搭载自研大模型 Psi-R2,初步测算可降低生产损耗率约 10%。未来不远机器人以 3000 元/月租赁价落地 500 多个家庭,开展首日 8 台被抢空。
日冕开物与广东远图未来科技启动超级工站战略合作,计划2027年完成百台级部署,未来实现万台级具身智能产品部署。WAIC 2026现场,其超级工站基于自研LaMPA世界模型,在通电后仅训练半小时即完成服务器制造场景的新环境适配。该方案由LaMPA物理世界模型、模块化机器人硬件和Workflow Agent组成,目标形成规划、测试、执行、反馈、进化的闭环。
联影智能在2026年世界人工智能大会上首次发布「元医院」战略,不新建虚拟医院、不替代医生,而是把零散AI工具整合为全院协同的智能体系。该体系需数据、模型、智能体调度、临床验证四项能力,并已开源uAI Nexus MedVLM(元智医疗视频理解大模型)。WAIC现场演示了「超级医生」:医生戴VR头显语音调取患者全周期病历,并完成肝脏实质剥离等术前规划操作。
OOMWOO 是一款完全开源的扫地机器人,从硬件到软件均不依赖任何云服务,依靠树莓派运行 ROS 2,并使用低成本 2D 激光雷达实现房间感知与建图。该项目大部分零件需 3D 打印,可便捷接入 Home Assistant 等现有开源工具,目前软件开发基本完成,物料清单仍在整理中,由志愿者在 GitHub 上协作推进。
酷哇科技在 WAIC 2026 披露行业首个双层智能体世界模型 COOWAM,由负责物理规律的 CooWAIM 与理解社会规则的 Urban VLM 组成,现场驱动机械臂自主完成切西瓜、拧瓶盖、制作“夏日特调”等长程操作。同期首款重载型四足机器狗 X0 线下首秀,具备 68kg 重载能力,已完成多场景验证并步入真机部署阶段。
ROBOTIS 人形机器人部门发布开源 Physical AI 平台 Cyclo Intelligence,面向 AI Worker 的模仿学习工作流,把遥操作数据采集、数据集转换、模型训练(支持 GR00T、PI、ACT 等)和真机实时推理整合为端到端流程。
由 buildfarmers 在 ROS、Gazebo 与 Infra PMC 支持下开发的 Buildfarm Dashboard 现已上线,用于集中展示 ROS 和 Gazebo 的基础设施构建与测试错误、错误实时状态及是否已被上报的跟踪信息。团队希望用户试用后就页面导航、界面对新老贡献者是否直观以及功能与 UI/UX 建议提交反馈。
对 14 个机器人课程的基准测试显示,没有一个定义能力模型、提供分支进阶或开放式学习者标准参照评估。该 v0.1 讨论稿提出四阶段能力模型(按可观察工作而非课程完成度划分)、以 tf2+URDF 为骨干的技能树,以及五处学习者流失缺口的映射。11 份招聘样本中 10 份要求生产级 ROS 2,8 份要求 C++ 与 Python。
特斯拉在二季度财报电话会前一天,将数量未公开的无监督 Model Y 投入奥兰多和坦帕,这是其在佛罗里达州试运营 robotaxi 的第三座城市,此前几周刚在迈阿密小规模上线。两座新城市运营区域较小,特斯拉未公布更多细节;其此前宣布的达拉斯和休斯顿自动驾驶车队尚未扩大规模。
ROS 计划将 Rolling 到主镜像的同步从发布团队手动触发改为自动触发,候选批次达到就绪阈值即同步,阈值由批次规模和包在依赖图中的位置决定。低风险叶子包将更快进入主镜像,下游影响广的包则需更长验证与浸泡时间;阈值会随 M Turtle(2027 年 5 月)发布临近而收紧、发布后放宽。
Nvidia Jetson 全系套件与模组涨价 50%-100%,有用户在 ROS Discourse 发帖征集替代方案并附投票。讨论中 RK3588 被多次提及,Orange Pi 5、NanoPC T6 均基于该芯片,8GB 内存板卡约 200 美元起,且带 h264 硬件编码便于远程监控与遥操作。
作者开源了 ros2-fast-stereo,一个基于 ROS 2 Jazzy 的实时立体深度估计工作区,用 TensorRT 加速移植 NVIDIA 的 Fast-FoundationStereo 模型。
Gritt 结束隐身状态,宣布完成由 Obvious Ventures 领投的 2600 万美元 A 轮融资,累计融资 3200 万美元。该公司由两位卡内基梅隆背景的机器人专家创立,不自建机器人本体,而是用 Kawasaki 机械臂等现成硬件搭配自家 AI 模型,首个任务是卸载并定位大型玻璃太阳能板,精度达亚毫米级。
ANYbotics 将在巴塞罗那 DFactory 举办第八届 ROS Meetup,时间是 9 月 17 日周四 17:30–21:00。活动包括工程师技术分享、DFactory 参观与 ANYmal 现场演示,以及巴塞罗那机器人社区的开放交流。
Pollen Robotics 发布开源低成本系统 Grabette,用手持夹爪加双摄像头录制操作示范,自动转成 LeRobot 格式数据集。Grabette 硬件物料成本约 490€,配套机械臂末端夹爪 Gripette 约 120€,采集数据经 RTAB-MAP SLAM 处理后在浏览器中完成转换。
推荐理由:开源手持夹爪加浏览器处理流程,把真机操作数据采集从遥操作里解放出来,可据此判断数据采集门槛的变化。
Apple-PI 提出一个以物理定律为锚的基准,用分阶段推理评测诊断视频生成模型在模拟经典力学时的失效位置。该基准包含 Orchard 数据集,覆盖经典力学十类典型任务的 400 段视频,区分单定律与多定律任务;评测协议分感知、公式化、演绎三阶段,采用链式帧提示,并将生成视频视为模型的可见推理轨迹。
Gazebo PMC 于 2026-07-20 召开周会,讨论将 backports 跟踪仪表盘和旧版 gz-dashboard 仓库整合到 gazebosim 组织下的集中仓库,并计划引入自动提交分析以识别需发版的 PR。
团队发布 gym-gazebo-sim,将 erlerobotics 在 ROS1 与 Gazebo Classic 上的 gym-gazebo 框架移植到 ROS2 Jazzy 与 Gazebo Sim Harmonic,用于训练强化学习智能体。该工具设计为可在低性能电脑上运行,将用于其机器人学本科入门课程,并会随使用持续演进。
ReflectWorld-MM 是一个面向开放视频流的实体导向多模态记忆系统,用分层长期记忆围绕持续存在的实体组织观察,以改进跨时间的跟踪与推理。系统包含三部分:在有限短期记忆下把音视频流转化为实体解析观察的感知前端、基于人类记忆理论的分层长期记忆(耦合多尺度情景记忆、演进的实体中心语义记忆与程序性记忆),以及可接入现成助手的完整实现。
推荐理由:论文提出面向开放视频流的实体导向多模态记忆系统,读者可了解其分层记忆结构与六项基准表现。
作者发布 PyZeROS,一个用纯 Python 从零编写的 rclpy 替代方案,通过 Zenoh 与标准 ROS 2 节点互操作,支持 Jazzy 和 Lyrical,可用 pip install pyzeros 安装,无需 ROS 安装、colcon 工作区或消息编译。
RynnBrain 1.1 发布,是覆盖 2B、9B 和 122B-A10B 三个规模的具身基础模型家族,在 1.0 基础上为全系列引入接触点预测,并为 2B 和 9B 模型加入原生 3D 定位。
推荐理由:RynnBrain 1.1 在 1.0 基础上加入接触点预测与原生 3D 定位,并给出多本体真机部署结果,可据此了解具身基础模型的能力边界。
JoyNexus 是面向视觉语言动作(VLA)模型的多租户服务,通过解耦 API、隔离租户槽位和分组批处理,支持共享资源上的训练、推理与评估。它解耦训练模型服务、推理模型服务和环境服务,各租户的动作模块、优化器、rollout 记录与策略版本相互隔离,由全局训练队列和推理队列调度。仿真与真实具身场景评估显示,相比单租户独立执行,JoyNexus 降低了总 GPU 时间并提升了服务利用率。
DiffGI 用连续 2D TSDF 和可微 Marching Squares 模块替换几何图像中的二值占用图,使整条流水线端到端可微,可在消费级 GPU 上约一秒完成高保真薄壳 3D 生成,甚至能在笔记本 CPU 上运行,无需服务器。项目主页已上线,交互式 demo 即将推出。
OnSLAM 是一款开源 Windows 应用,可直接对 ROS1 bag 文件运行 LiDAR-惯性里程计与建图,自动识别兼容的 LiDAR 与 IMU 话题,在本地运行建图流程,并在浏览器中可视化轨迹与点云地图,导出 PLY 和 PCD 文件。
一位开发者正在构建模块化开源 CNC 龙门平台,通过更换末端执行器即可适配激光雕刻切割、PCB 绘图、拾放自动化和视觉引导机器人等应用。项目采用模块化铝型材框架与可互换工具头,运动控制基于 GRBL/FluidNC/LinuxCNC,并用 OpenCV 做计算机视觉集成。目标是让创客、教育者和研究者复用统一运动平台,而不必从零重做机械结构。