OnSLAM:在 Windows 上直接对 ROS1 bag 运行 LiDAR-惯性建图
OnSLAM 是一款开源 Windows 应用,可直接对 ROS1 bag 文件运行 LiDAR-惯性里程计与建图,自动识别兼容的 LiDAR 与 IMU 话题,在本地运行建图流程,并在浏览器中可视化轨迹与点云地图,导出 PLY 和 PCD 文件。
OnSLAM 是一款开源 Windows 应用,可直接对 ROS1 bag 文件运行 LiDAR-惯性里程计与建图,自动识别兼容的 LiDAR 与 IMU 话题,在本地运行建图流程,并在浏览器中可视化轨迹与点云地图,导出 PLY 和 PCD 文件。
一位开发者正在构建模块化开源 CNC 龙门平台,通过更换末端执行器即可适配激光雕刻切割、PCB 绘图、拾放自动化和视觉引导机器人等应用。项目采用模块化铝型材框架与可互换工具头,运动控制基于 GRBL/FluidNC/LinuxCNC,并用 OpenCV 做计算机视觉集成。目标是让创客、教育者和研究者复用统一运动平台,而不必从零重做机械结构。
面壁智能在WAIC期间发布并开源MiniCPM-Robot系列模型,包含1.5B的通用VLA模型MiniCPM-RobotManip和0.9B的跟踪导航模型MiniCPM-RobotTrack,并同步开源具身智能推理框架PhyAI。
推荐理由:面壁开源1.5B与0.9B两个机器人模型,读者可据此了解小尺寸VLA在记忆与端侧部署上的取舍。
Genesis 发布 v1.2.3,新增带高阻抗选项的椭圆摩擦锥,用于高保真静态摩擦建模,并改进 fp32 精度下约束求解器的收敛性。该版本还支持批量渲染器中的异构实体、射线传感器仅距离模式,并修复 USD、MJCF 解析及质量矩阵等问题,非批量 CPU 仿真提速最高 30%。
开发者展示了一台基于 AgenticROS 的新机器人,通过 OpenClaw、Claude、Gemini、Codex 和 Hermes 等 AI Agent 连接 ROS2,实现对 RealSense、轮子、腿和手臂等自身本体的控制。
pycoordination 发布,是 Örebro University 多机器人轨迹包络协调器 coordination_oru 的 Python 移植,保留松散耦合、在线连续协调与死锁重规划等特性。
原力灵机发布首款具身世界模型 DW0.5,并接入世界模型驱动的具身智能后训练框架 DFOL2.0。DW0.5 由 Video Expert、Action Expert、Value Expert 三大专家模块组成,用上万小时真机多视角数据联合预训练,可预测动作执行后的未来状态并生成失败轨迹,据其披露可让后训练中真机数据需求骤降 60%、整体训练成本下降 40%。
推荐理由:原力灵机披露 DW0.5 世界模型接入后训练框架的完整闭环,读者可了解其三大专家模块设计与真机数据需求下降 60% 的实测数据。
ros2_lingua 是一个让机器人运行时自注册能力(名称、描述、参数、实际 ROS action/service)的开源项目,使 LLM 只能看到实时且落地的动作列表,避免调用不存在或不可达的动作。
Gaurav-x111 发布 ros2_info,一个用 Rust 编写的 fastfetch 风格 ROS 2 终端仪表盘,单静态二进制、MIT 许可,支持 Humble/Jazzy/Iron/Rolling,可在 SSH 无头环境及 Pi/Jetson 类硬件上运行。
LinkForge 在 Blender Extensions 平台下载量突破 5000,作者借此提出为机器人描述引入可编程中间表示(IR)的构想。该 IR 可编程组合机器人模型、在导出前校验运动学与物理属性,并编译为 URDF、XACRO 等格式。其目标并非取代 URDF 或 ROS,而是在现有 ROS 工作流之前提供工具无关的编写与校验层。
阿里巴巴旗下高德发布通用世界模型工坊ABot-World Studio并开放测试,可将文字或图片生成可实时交互的AI世界,输出为视频与3DGS文件。该工坊可在单张5090上本地部署,官方实测单次连续推理稳定运行超1小时且无质量衰减,并内置“时空任意门”实现3D世界间跃迁。底层ABot-World0与ABot-3DWorld0模型已全面开源,官网、GitHub及Hugging Face同步上线。
推荐理由:高德把交互式视频与3DGS场景生成统一进一个工坊,并开源模型,读者可据此了解世界模型的一条新路径。
作者发布并开源了 RoboShield,一个用 Rust 编写的实时 RTPS 安全看门狗,部署在链路上嗅探 DDS/RTPS 数据包,用于发现恶意节点入网、/cmd_vel 洪泛和未授权发布者劫持话题。
OpenAMRobot v0.0.1 发布,这是该开源移动机器人平台的首个产品级版本,基于 ROS 2 Jazzy,面向机器人研究、教育、快速原型和早期具身智能开发。
Drew Smith 发布纯 Python 项目 Kindalive,用多巴胺、皮质醇等八种神经化学物质的模拟衰减与相互作用实时推导情绪状态,而非用大语言模型给文本打离散标签。它通过调整 FACS 面部动作编码系统中的十二种面部动作,驱动点阵机器人脸表达短期与长期情绪,也可用于真实 LED 矩阵或动画脸舵机。
SW2GZ 是一个 SolidWorks 插件,可将装配体直接导出为可启动的 ROS 2 包或 Gazebo(Gz Sim)模型/世界,无需手写 URDF。它从 SolidWorks 模型读取质量、惯量、关节坐标系和配合,提供 Robot、World、Asset 三种导出模式,关节类型由配合推导。
OpenRAL 发布开源机器人智能层(RAL),定位为物理 AI 的运行时框架,在 ROS 2、tf2、MoveIt 2、Nav2、ros2_control 之上用 Pydantic v2 schema 建立各层之间的类型化契约。
作者开源了命令行工具 robot-triage,可对 .bag 或 .mcap 文件自动标记传感器掉线、错误突发、位姿跳变、指令与实际偏差、数值冻结和超范围读数等问题。
蚂蚁灵波开源 LingBot-Video,称其为面向具身智能的大规模 MoE 视频基础模型,采用 30B 参数、推理时激活约 3B。模型引入超 70000 小时具身相关视频,覆盖机器人操作、导航与第一视角等场景,并加入物理合理性、任务完成度等多维奖励。团队称其在 RBench 上超过通用视频生成标杆模型,并已在 TI2V 任务的开源竞品中达到 SOTA。
Hugging Face 的 LeRobot 发布 v0.6.0,带来多项破坏性变更:pip install lerobot 不再包含数据集与训练依赖,需按需安装如 lerobot[training]。
推荐理由:LeRobot v0.6.0 的破坏性变更清单和新增基准、策略,能帮现有用户判断升级成本与可迁移能力。
蚂蚁灵波发布并开源通用 VLA 模型 LingBot-VLA 2.0,预训练数据达 6 万小时,其中 5 万小时来自覆盖 20 种机器人构型的真机轨迹数据,1 万小时来自第一视角人类操作视频。
推荐理由:蚂蚁灵波开源 LingBot-VLA 2.0,读者可了解其 6 万小时数据规模、20 种本体覆盖及 GM-100 对比结果。
Image2Sim 是一个实时神经仿真框架,可从带位姿的 RGB-D 图像序列构建可交互的具身导航环境。相关代码与具体使用说明已在 GitHub 页面发布。作者感谢 Gim Hee Lee 教授的指导,以及阿里巴巴、香港科技大学的 Yinghao Xu 教授提供的 64 张 H20 GPU 支持。
推荐理由:Image2Sim 用带位姿的 RGB-D 序列生成可交互导航环境,读者可了解神经仿真如何降低具身导航的数据门槛。
PointDiT 是一种基于普通 ViT 的极简像素空间扩散 Transformer,直接处理原始 3D 点图块,并以预训练 DINOv3 的图像 token 为条件,扩散主干完全从零训练,无需点图 tokenizer。它在单图 3D 重建上超越了复杂的潜空间扩散模型,同时比混合架构更简单,几何结构更锐利,在透明物体等高度歧义区域更稳健。
openJiuwen 社区发布多模态 Skill 范式 Skill-Omni,并在 JiuwenSwarm 中默认提供 skill-omni-creation,可将网页链接或 B 站视频链接自动提取关键截图、界面状态与操作脉络,生成 Agent 可直接读取复用的多模态 Skill。
蚂蚁灵波开源空间原生视觉基模 LingBot-Vision,并发布基于它的空间感知模型 LingBot-Depth 2.0。
7月7日,蚂蚁集团旗下灵波科技发布空间感知模型 LingBot-Depth 2.0,训练数据从300万扩充至1.5亿规模,在深度补全基准16项测评中获12项第一,室内大面积深度缺失场景RMSE从0.132降至0.062。
LeRobot v0.6.0 发布,引入 VLA-JEPA、LingBot-VA、FastWAM 三个世界模型策略,以及 GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT 等新 VLA 和 Robometer、TOPReward 奖励模型 API。
推荐理由:LeRobot v0.6.0 一次放出世界模型策略、多个 VLA 与奖励模型 API,读者可据此判断开源机器人学习栈的能力边界。
Gazebo PMC 在 2026-07-06 的会议上同意设立每月约两次、跨时区轮换的维护小时,供维护者通过分组会议协作审查 PR。会议讨论了 SDFormat 新的命名空间占位符语法(__name__、$name、{name} 等),最终选择推迟,并倾向不回溯到 Fortress 而面向 Harmonic。
AffectGuard-HRI 是运行在 ROS 2 Jazzy 上的社交/家庭机器人框架,将视频(FER+ ONNX)与音频(MFCC + ONNX)情感节点融合为 fused_emotion_state,再由规则引擎提出动作、经不可覆盖的安全包络钳制后才执行。
针对 CAD、URDF 导出器和切片软件把 3D 打印件当作实心塑料块计算惯量、导致 MuJoCo/PyBullet/Gazebo 仿真动力学失真、拉大仿真到真实迁移差距的问题,开发者用 LeRobot SO101 机械臂测试后开源了 printphys 工具。
ROBOTIS 在 AI Worker 上发布基于行为树(BT)的全身 VLA 框架,将 GR00T N1.7 的 VLA 策略与确定性规则控制结合,用于处理复杂长程全身任务。
开发者 Vladimir Privalov 为索尼 PlayStation 5 HD 相机实现了一个 ROS 2 节点,让这款 60 美元、支持 1080p 60 FPS 的双目相机更易接入 ROS 2。
ros2_rust 维护者发布新 crate ros-env,让 Rust 项目通过普通 Cargo 依赖直接访问已 source 的 ROS 2 环境中的消息类型,无需 Colcon,也无需使用 ros2_rust。若已用 rosidl_generator_rs 生成消息接口代码,即可从任意包中调用消息类型,目标是统一 Rust ROS 2 客户端消费与共享消息定义的方式。
作者发布 Altara,一套 MIT 许可的 React 实时遥测组件,提供一行 rosbridge 适配器,可将 sensor_msgs 话题直接接入图表、仪表或姿态指示器。
kc_vision 是一个完全开源的自主地面机器人项目,仿真栈可在 Ubuntu 24.04 上开箱运行,无需硬件。它用 SLAM Toolbox 或 Google Cartographer 建图,通过 Nav2 在 RViz 中自主导航并避障,还能跟随 GPS 航点并在无地图情况下用牛耕式覆盖规划器清扫户外区域,行距 0.2 m 可配置。
MIT 与宾夕法尼亚大学的研究者提出开源轨迹规划系统 MIGHTY,让无人机在毫秒级响应障碍的同时保持平滑航线并缩短飞行时间。该系统用 Hermite 样条把飞行时间与路径放在一步内联合优化,并借助激光雷达地图迭代细化初始轨迹,仅靠机载计算与传感器即可实时飞行。
ROS 2 的 lyrical 仓库新增了全部发布版本记录,由 Shane Loretz 提交并完成 lint 检查。系统测试哈希被保留作为记录,system_tests 同时被打上标签。
Zenoh 1.9.0 发布,带来 Regions 破坏性变更,并默认启用 unsafe_op_in_unsafe_fn。新版本支持按优先级分配 QUIC 流、通过非安全 QUIC 为 UDP 链路增加可靠性,并新增混合可靠性 QUIC。此外修复了 1.7.2 引入的 500ms scouting 延迟回归及 RuntimeState 泄漏等问题。
IsaacLab 为 Linux 多 GPU 训练文档补充 NCCL 排障说明,针对 ProcessGroupNCCL 报出 CUDA "an illegal memory access was encountered" 导致分布式训练失败的情况,给出 NCCL_SHM_DISABLE=1、NCCL_IB_DISABLE=1、NCCL_ALGO=Ring 三个环境变量变通方案。
IsaacLab 合并 #5195,在多 GPU 训练文档中新增 NCCL 故障排查说明,针对 Linux 上分布式训练报 ProcessGroupNCCL 的 CUDA illegal memory access 错误。
Hugging Face 的 LeRobot 发布 v0.5.1,为 pi0、pi0.5 和 pi0_fast 策略新增相对动作支持,并加入 HIL/Dagger/HG-Dagger/RaC 风格数据采集功能。