AI 日报 · 2026 年 10 月 8 日 · 星期四
具身雷达
ReDex 实现仿真到真实灵巧操作策略修复
ReDex 通过手指级柔顺交互修复仿真到真实的灵巧操作策略,人工在柔顺控制下纠正选定手指的接触失败,冻结的基础策略继续控制其余手指,并利用触觉反馈训练独立的力条件策略。同日,SMART 提出基于大规模合成预训练的零样本仿真到真实关节物体操作,ACG-WAM 通过动作条件几何隐空间预测实现世界动作建模。
论文研究
ReDex:通过手指级柔顺交互修复仿真到真实的灵巧操作策略
ReDex 是一个将仿真训练的灵巧操作策略适配到真实世界的框架,通过人工在柔顺控制下纠正选定手指的接触失败,同时冻结的基础策略继续控制其余手指,并利用触觉反馈训练独立的力条件策略。
SMART:基于大规模合成预训练的零样本仿真到真实关节物体操作
SMART 提出一套面向关节物体操作的可扩展系统,核心是具备关节感知设计的仿真平台 SMART-Sim,用于任务生成与示范采集。基于该平台合成 SMART-Data,包含超过 100 万条示范,覆盖 44 种原子任务类型、5 种机器人配置和 2507 个关节物体。在该数据上预训练的视觉语言动作(VLA)模型在仿真基准上表现有竞争力,并在真实关节物体操作任务中实现零样本仿真到真实迁移。
ACG-WAM:通过动作条件几何隐空间预测实现世界动作建模
ACG-WAM 提出辅助目标 ACG-JEPA,从当前观测与中间动作预测多个时间尺度的几何特征,目标为冻结 VGGT 编码当前与未来图像对后的未来槽位,并在时序混合前用头部与腕部相机监督共享视觉嵌入。
嵌入式裸机雷达惯性里程计:单核微控制器实现与飞行实验
研究提出一种面向低算力平台的嵌入式雷达惯性估计器,所有传感器驱动、数据处理与辅助惯性导航均在单核微控制器上完成。飞行实验显示,相对动捕的平移 APE 为 0.51-0.82 m,RPE 小于 3%,并在未修改的 PX4 栈上完成闭环飞行。固件与印刷电路板设计已在 GitHub 开源(ntnu-arl/embedded_rio 与 ntnu-arl/embedded_rio-pcb)。
OntoPlan:面向可扩展机器人任务规划的本体论场景表示与智能体框架
OntoPlan 提出本体论场景表示与智能体框架,将物体、空间、关系和状态对齐到共享符号词汇,用于空间推理与任务规划。在覆盖五个室内环境、三种场景尺度的150个通用任务上,平均任务成功率为0.89,最强基线为0.27;平均每任务消耗18.1k token,约为最高效基线的5.6分之一。
Seeing Through the Displaced Frame:面向视觉-力精密装配的特权噪声蒸馏
该论文针对精密装配中位姿误差同时污染观测与动作坐标系的问题,提出在训练期注入特权信息的两条路径:特权教师可在仿真中观测偏移量,干净示范也可闭式重标注到偏移坐标系。
BiGym 2.0:面向 Unitree G1 人形家务操作的策略评测基准
BiGym 2.0 将 BiGym 适配到 Unitree G1,覆盖 20 项家务任务,并用统一全身控制器进行示范与评测,每项任务提供 60 条真人 VR 示范及同步多相机视角和全身执行记录。
ROMA:面向真实世界物体的多感官主动感知 LLM 系统
ROMA 是一个基于 LLM 的真实世界物体中心多感官主动感知系统,将视觉、音频、触觉和力觉整合进推理-交互-反馈回路,由模型判断缺失证据并决定目标物体、交互方式与模态,再由物理接口执行交互并采集多感官反馈。
快讯
- BRACE:面向受力与地形感知的人形机器人全身运动跟踪方法arXiv cs.RO
- OCBench:可复现行为克隆反常现象的机器人操作基准arXiv cs.RO
- AIM:面向真实到仿真软体模拟的自适应交互建模网络arXiv cs.RO
- Grounded Superintelligence 发布 RoboCap 第一视角机器人学习采集平台arXiv cs.RO
- SharedKV-BT:行为树智能体的节点局部类型化决策arXiv cs.RO
- 风险敏感人群导航:自适应椭球共形预测方法arXiv cs.RO
- MobileVISTA:面向移动操作位姿泛化的生成式数据增强arXiv cs.RO
- PG-VP:面向温度与辐射感知 VLA 导航的物理引导视觉提示arXiv cs.RO
- 面向世界模型鲁棒决策的潜空间扰动建模arXiv cs.RO
- TacZero:用通用视觉语言模型加触觉反馈实现免训练插孔arXiv cs.RO
- EigenDEXplore:用人类先验结构化探索的灵巧操作arXiv cs.RO
- ESP:单步生成多模态动作的能量分数策略arXiv cs.RO