跳到正文

#导航

今日 6 条
今天10月1日周四
  1. arXiv cs.RO60

    LME:面向未知环境导航的局部极小值逃逸子目标生成框架

    作者提出 LME(Local-Minimum Escaper),一个程序化分层框架,通过显式生成并推理子目标,引导移动机器人脱离局部极小值区域。LME 仅依赖局部观测,用可解释的启发式准则结合障碍几何与候选位置安全性来选取子目标,再由局部规划器生成底层运动指令,无需额外训练且不依赖具体局部规划器。

    推荐理由:论文提出用可解释启发式生成子目标来摆脱局部极小值,且不依赖底层规划器、无需额外训练。

  2. arXiv cs.RO62

    DODGER:面向动态障碍物导航的安全引导强化学习框架

    DODGER 是一个安全引导强化学习框架,训练时直接执行策略生成的动作驱动 rollout,同时用控制屏障函数(CBF)过滤后的参考和约束违反来塑造避障行为,以避免仅执行安全过滤动作限制策略探索。作者通过 Dubins 车安全分析评估该方法,并在全阶人形仿真和基于 LiDAR 感知的真实人形实验中实现多动态障碍物下的目标导向导航,且不使用运行时安全过滤器。

    推荐理由:论文提出训练时直接执行策略动作、用 CBF 参考塑造避障行为,并在人形仿真与真机验证。

  3. arXiv cs.RO43

    Diffusion-2BC:混合扩散与回归训练用于自动驾驶离线行为克隆

    Diffusion-2BC 将扩散去噪目标与辅助确定性行为克隆损失结合在共享视觉编码器上,辅助分支仅用于训练,推理仍基于扩散。在 Claw 任务中,其平均掩码距离误差较扩散行为克隆基线降低约 10%,较标准确定性行为克隆降低 85%;在 CARLA 无路线导航中,于 Town01 和 Town02 均比两个基线行驶更远。

9月30日周三
  1. qbitai74

    斯坦福 HomeBody 让 GPT-6 Astra 调度宇树 G1 收拾厨房

    斯坦福团队项目 HomeBody 让 GPT-6 Astra 接入宇树 G1,在陌生厨房中按语言指令收拾物品、丢纸盒并从抽屉取药。系统先让 G1 探索建图,再由 Astra 作为 Real2Sim 智能体在 Isaac Sim 中重建数字厨房,之后由 Astra 调用导航、抓取、放置、开抽屉等可复用技能,底层用预训练 AMO 控制策略协调行走与操作。

  2. arXiv cs.RO62

    机器人上下文学习综述:方法与应用

    一篇题为《In-Context Learning for Robots: Methods and Applications》的综述将机器人上下文学习文献按上下文证据到执行的接口分为四类:上下文条件策略、几何示范迁移、基于世界模型的控制,以及基于技能与智能体的执行。

    推荐理由:这篇综述把机器人上下文学习拆成四类接口,并梳理了迁移假设与评测方式的差异,适合用来建立该方向的方法地图。

  3. arXiv cs.RO31

    MagNav:面向双轮机器人光照不变导航的双核磁轨引导框架

    MagNav 用五通道模拟霍尔效应传感器阵列实现双轮自平衡机器人的磁轨循迹,不受光照干扰。控制系统采用串级 PID:内环用 IMU 加互补滤波保持平衡,外环依据磁传感器读数调整转向,步进电机无需额外旋转编码器即可精确控制力矩。测试中磁引导在超过 10,000 Lux 强光下仍保持准确循迹,而对比的光学模块会失准甚至失效。

9月29日周二
9月28日周一
9月16日周三
9月15日周二
9月13日周日
9月11日周五
  1. qbitai38

    高德扫街榜2026全面AI化,空间智能引擎ABot-Earth 0.7亮相

    高德9月10日宣布扫街榜全面AI化,升级后的2026版用AI算法理解不同导航到店行为的评分权重。其空间智能核心引擎ABot-Earth 0.7被称为全球首个3D原生城市世界模型,仅需一张卫星图或一段文字,在消费级GPU上跑10分钟即可生成真实街景3D城市,效率比传统方法提升1000倍,已覆盖190多个国家、300多座城市。

9月1日周二
  1. HF blog71

    LightNav-0:用 VLM 空间智能实现通用具身导航

    LightNav-0 是一个紧凑的通用具身导航模型,通过统一指向 token 与动作 token 化调用预训练 VLM 的空间推理能力,在 10 个公开导航仿真设置上取得单目成功率最优。

    推荐理由:论文给出统一 token 接口把 VLM 空间能力接到导航动作上,可了解通用导航模型如何跨任务与本体复用。

8月28日周五
  1. HF blog62

    UrbanGround:基于香港全域三维数据的真实尺度城市智能体导航沙盒

    UrbanGround 是一个基于香港全域三维地理数据构建的真实尺度城市副本沙盒,用于测试多模态大语言模型智能体能否在闭环第一人称视角下完成可靠导航与空间推理。

    推荐理由:UrbanGround 用香港全域三维数据搭建可闭环交互的城市沙盒,读者可了解 MLLM 智能体在长程城市导航中的能力边界。

8月27日周四
8月22日周六
  1. qbitai38

    硅羽科技张富:给无人机装上通用大脑,让空中智能体自主作业

    硅羽科技创始人张富(李泽湘学生、前大疆8年产业顾问、香港大学副教授)正把港大MaRS Lab的自主导航技术转化为产品,让飞行器不靠GPS和飞手遥控,自主感知、决策并完成任务。公司半年内连续完成四轮融资,累计数亿元,投资方包括耀途资本、锦秋基金、阿里巴巴。今年年底将量产第一阶段产品,面向地下管廊、隧道、仓储厂房、桥下与森林等场景,产品重量不到一千克、续航20-30分钟。

8月12日周三
8月11日周二
8月8日周六
8月6日周四
8月5日周三
  1. ROS Discourse latest20

    Nav2 在 Isaac Sim 大型道路环境中出现 zigzag 导航,RViz 定位逐渐偏离仿真器

    一位 Nav2 新手在 Isaac Sim 中用搭载单个前置 2D LiDAR 的官方 Nova Carter AMR 做导航,小型室内工厂环境正常,AMCL 定位稳定;换到大型道路环境后机器人开始 zigzag 行驶,并逐渐偏离道路甚至跑到路边,而 RViz 仍显示机器人在路中央,与 Isaac Sim 中的实际位置明显不一致。

8月1日周六
7月25日周六
7月24日周五
  1. ROS Discourse latest75

    Nav2 开源机器人工作负载基准,测试完整自主栈算力平台

    Nav2 作者 Steve Macenski 开源了一套机器人工作负载基准,用完整自主栈运行叉车抓取放置任务,而非孤立的合成微基准。该基准处理来自 3D LIDAR、深度相机等的 9 路传感器流,在 180,000 平方英尺仓库中运行完整自主栈并叠加较重的 VLM 负载,已对 AMD Strix Halo、NVIDIA Jetson Thor 和 Orin AGX 进行测试。

7月22日周三
7月20日周一
  1. qbitai42

    光鉴科技发布具身智能视觉感知方案,推出 Libra 1000/3000 AI 双目视觉模组

    光鉴科技发布具身智能视觉感知方案,以AI双目视觉为核心,并推出Libra系列AI双目视觉模组:Libra 1000采用2cm基线面向腕部精细操作,Libra 3000采用7cm基线面向中远距离空间感知。方案采用全域泛化感知设计,以统一硬件平台支撑深度感知、SLAM定位、目标检测等任务并支持OTA升级,同时通过优化计算架构降低算力占用,为VLA推理等释放算力。

7月17日周五
7月14日周二
  1. ROS Discourse latest52

    OpenAMRobot v0.0.1 发布:基于 ROS 2 Jazzy 的开源移动机器人平台

    OpenAMRobot v0.0.1 发布,这是一个采用 MIT 许可、基于 ROS 2 Jazzy 构建的开源移动机器人平台,面向教育、研究、实验和快速原型开发。当前版本包含自主导航、SLAM 与建图、仿真支持、自主对接、基于网页的操作界面,以及通过 ROS 2 操作该机器人的工具和示例。作者在 ROS 社区征集关于系统与包架构、安装与文档、开发者体验及后续路线图的反馈,并欢迎贡献和问题建议。

7月13日周一
  1. ROS Discourse latest58

    ROBOTIS 发布 Cyclo Intelligence UI,演示建图与导航

    ROBOTIS 发布 Physical AI 平台 AI Worker 的最新更新,演示用基于网页的 Cyclo Intelligence UI 完成建图与导航,无需处理复杂的命令行配置。整个 Cyclo Intelligence 生态完全开源,官方提供了演示视频、GitHub 代码仓库和文档链接。评论区指出该项目名与另一项目存在重名,作者回应将改名。

7月11日周六
7月8日周三
  1. HF blog67

    Image2Sim:用生成式神经模拟器扩展具身导航

    Image2Sim 是一个实时神经仿真框架,可从带位姿的 RGB-D 图像序列构建可交互的具身导航环境。相关代码与具体使用说明已在 GitHub 页面发布。作者感谢 Gim Hee Lee 教授的指导,以及阿里巴巴、香港科技大学的 Yinghao Xu 教授提供的 64 张 H20 GPU 支持。

    推荐理由:Image2Sim 用带位姿的 RGB-D 序列生成可交互导航环境,读者可了解神经仿真如何降低具身导航的数据门槛。