跳到正文

全部动态

今日 69 条
今天10月1日周四
  1. arXiv cs.RO55

    技能条件视觉触觉表征与进度引导事件记忆:按技能融合视觉与触觉

    论文提出一种技能条件表征,让查询到的技能对模态特定的短期观测 token 进行融合,并关注保留最近 K 个已执行技能终末观测的稀疏事件记忆。在三个接触密集任务上以技能进度估计评估,滑移检测延迟较微调 SOTA 进度模型降低 87%,扭转完成延迟较纯视觉消融降低 67.5%,盲搜索任务的进度误差通过稀疏事件记忆降低 92%。作者认为观测构建而非仅策略架构是多模态表征的核心挑战。

  2. arXiv cs.RO59

    CADeT:面向软组织间接机器人操作的因果感知形变传递框架

    CADeT 是一个因果感知的形变传递框架,将结构因果模型与主动感知结合,在线推断潜在传递模式并估计状态相关的黏附雅可比矩阵。在操作过程中控制动作更新模式信念,当歧义持续时选择额外探测动作以提高模式可区分性,模式信念与学到的雅可比矩阵被纳入信念感知模型预测控制器用于间接目标形状控制。

  3. arXiv cs.RO43

    Diffusion-2BC:混合扩散与回归训练用于自动驾驶离线行为克隆

    Diffusion-2BC 将扩散去噪目标与辅助确定性行为克隆损失结合在共享视觉编码器上,辅助分支仅用于训练,推理仍基于扩散。在 Claw 任务中,其平均掩码距离误差较扩散行为克隆基线降低约 10%,较标准确定性行为克隆降低 85%;在 CARLA 无路线导航中,于 Town01 和 Town02 均比两个基线行驶更远。

  4. arXiv cs.RO62

    L1-MPPI:面向敏捷无人机控制的 L1 自适应模型预测路径积分

    论文提出 L1-MPPI,将 L1 自适应控制与模型预测路径积分(MPPI)级联,用于提升高速无人机轨迹跟踪精度。该方法在 MPPI 的动态模型中纳入底层飞行控制器与电机动力学,并加入迭代混合方案,以应对模型不确定性和外部扰动。

    推荐理由:论文把 L1 自适应控制与 MPPI 级联,给出负载扰动下的跟踪误差对比数据,可参考其控制架构与实验设置。

  5. arXiv cs.RO57

    TrafficSignBench:面向交通标志合规的闭环评测基准

    TrafficSignBench 是一个以交通标志为中心的大规模基准,用于系统且可解释地评测自动驾驶规划器的交通规则合规性。该框架结合真实地图仿真与规则定向的程序化场景生成,实现 34 类交通标志对应规则的自动违规检查,产出 29,000 个道路场景和 29 种测试场景类型,并构建 5,800 个测试场景。

  6. arXiv cs.RO66

    BIND:将 3D 机器人动作绑定到 2D 图像特征的动作表示

    作者提出 BIND,一种将 3D 机器人动作绑定到对应 2D 图像特征的视觉运动策略动作表示,通过相机几何而非学习来提供动作与特征的关系。它离散化候选末端执行器位置体积,把每个候选与各相机视角投影处的预训练特征关联,再对候选的位置与图像绑定特征组合打分来选动作。在真机上,BIND 在少至 5 次示范的任务上取得接近完美的成功率,并在相机视角大幅偏移和未见物体位置下表现稳健,而坐标回归基线完全失败。

    推荐理由:BIND 用相机几何把 3D 动作绑定到 2D 图像特征,读者可了解其数据效率与视角鲁棒性的真机验证方式。

  7. arXiv cs.RO42

    基于对操作者推断的具身感知控制:一项仿真研究

    研究提出通用具身引擎(UEE),通过隐式注视与瞳孔信号及任务结果推断操作者的具身感和视本体线索权重,以离散主动推断智能体在显式偏好下选择有界设备设置。在300个异构合成操作者的仿真中,UEE多数在半分钟内找到合适设置,后半程具身感达1.68,接近预言机的0.73(0-2量表)。无模型赌博机表现更差,朴素预测误差最小化器会扣留反馈并降低任务成功率(0.74对0.90)。

  8. arXiv cs.RO62

    PneuTac:用统一 MPM-高斯泼溅仿真实现软体气动机器人触觉操作

    PneuTac 提出一个面向软体气动机器人触觉反馈操作的统一仿真框架,用物质点法(MPM)建模软体机器人与可变形触觉膜动力学,用 3D 高斯泼溅(3DGS)做渲染,并通过基于视觉的简单方法完成真实到仿真建模,再训练动作与感知网络作为代理模型加速仿真。

    推荐理由:提出软体气动机器人与触觉传感的统一仿真框架,为触觉操作策略的仿真增强训练提供可复用思路。

  9. arXiv cs.RO58

    Draft:面向机器人设计探索的参数化工具

    作者提出参数化生成工具 Draft,其通用引擎可将任意串行链参数树编译为可直接仿真的 MJCF 模型,无需 CAD。Draft 用对 114 个执行器和 49 份已发表机器人描述的调研拟合趋势来约束设计自由参数,并通过构建四款现成机器人的数字孪生验证,质量几何平均折叠误差为 1.10 倍。作者还用两阶段强化学习课程评估三款四足机器人,展示该工具如何呈现设计权衡。

  10. arXiv cs.RO62

    Memorize, Adapt, Ignore:诊断训练数据变化下的机器人学习机制

    该研究用经验神经正切核(NTK)作为诊断工具,考察训练数据变化如何影响机器人操作策略的内部学习机制。在 ManiSkill 的 pick-and-place 强化学习以及 LIBERO、RoboTwin 上 VLA 模型微调中,随机化物体尺寸、颜色、类型、场景光照和语言提示,NTK 能区分策略是在记忆不同情形、适应具体情形,还是忽略任务无关因素。

    推荐理由:用经验神经正切核区分策略是在记忆、适应还是忽略训练数据变化,为域随机化设计提供可操作的诊断信号。

  11. arXiv cs.RO41

    GestAdapt:面向人形机器人的工作空间条件化共语手势生成

    GestAdapt 是一个以预设腕部工作空间为条件的共语手势生成框架,从六个共语语料库学习共享运动表示,并支持重定向到不同机器人本体。用户研究中,修改工作空间约束下生成的手势平均质量得分为 3.24/5,高于无工作空间变体(2.43/5),低于参考动作(3.68/5)。在 Reachy2 人形机器人真机评测中,该框架生成的动作在 69.7% 的对比中排名第一。

  12. arXiv cs.RO62

    TALK-Dem:面向痴呆症沟通模式的具身任务规划基准

    作者提出 TALK-Dem,首个评估 LLM 驱动机器人任务规划在痴呆症相关言语沟通下表现的基准,包含 4,800 条指令,覆盖指代不精确、对象替换、空语、话题漂移和侵入五种沟通模式及三个强度等级。

    推荐理由:论文给出面向痴呆症沟通模式的机器人任务规划基准与检索式缓解方法,可了解辅助机器人在非理想指令下的鲁棒性缺口。

  13. arXiv cs.RO60

    SynIL:利用运动协同度从不完美示范数据集中做离线模仿学习

    SynIL 是一个面向离线模仿学习的自动化、免标注示范质量评估框架,基于运动协同度这一低维协调结构与运动熟练度相关的神经科学证据,通过自监督奖励回归生成密集的逐 transition 奖励信号。在 D4RL 运动基准和多人类 Robomimic 操作数据集上,协同度导出的奖励与真实奖励强相关,性能显著优于行为克隆(BC),与使用真实环境奖励训练的离线强化学习相当,在稀疏奖励的人类遥操作场景中更优。

    推荐理由:提出用运动协同度自动评估示范质量并生成奖励信号,为不完美示范数据集的离线模仿学习提供免标注思路。

  14. arXiv cs.RO66

    Fiatlux:面向人形机器人爬梯与换灯泡的长时程基准

    Fiatlux 是一个基于 NVIDIA Isaac Lab 的长时程基准,让 Unitree G1 人形机器人在一个回合内把梯子放到天花板或墙壁灯具下、爬梯、把灯座里的旧灯泡换成新灯泡,并把旧灯泡放进回收箱。

    推荐理由:Fiatlux 把爬梯与换灯泡合成一个长时程基准,并给出十二个子任务与三类基线,可供人形操作评测参考。

  15. arXiv cs.RO60

    螺旋软体机器人全身抓取与抛掷的优化学习精炼框架

    研究提出面向软体连续机器人的优化-学习-精炼框架,用基于结果的动作空间优化实现从初始未抓取状态开始的全身抓取与拾取抛掷。抓取以末端角扫掠和身体-物体包裹度量化,抛掷还纳入释放方向对齐与最低释放速度,采用无导数CMA-ES应对非光滑的动作到结果映射。

    推荐理由:论文给出软体连续机器人全身抓取与抛掷的无导数优化框架,并附仿真与真机成功率数据。

  16. Hackaday robots22

    多伦多大学学生打造 Pogo-Bot 单腿跳跃机器人,弹性足垫适应沙地冰面

    多伦多大学工程学生将弹簧跳杆、四旋翼与单腿结构结合,做出名为 Pogo-Bot 的单腿跳跃机器人,靠四个螺旋桨提供推力、弹簧腿完成弹跳。早期版本仅用尖刺足端,失败频出;改用带弹性带张紧、可枢转的尖刺足垫后,机器人能在软沙到硬冰等全地形保持直立,不再被冰面滑飞。

  17. genesis releases22

    Genesis v1.4.3 发布:提升 GPU 仿真速度并降低显存占用

    Genesis 发布 v1.4.3,重点提升 GPU 上非批处理至中等批量(约 4000)的仿真速度并全面降低显存占用,Windows 上编译速度最高提升至 3 倍。该版本还修复了 glTF 解析、MJCF 材质纹理保留、Apple Metal 性能模式编译失败、IMU 读数记录与相机外参更新等多项问题,并升级至 Quadrants 1.3.3。

  18. TechCrunch robotics42

    Destro AI 用智能层让机器人与人类协同,获 800 万美元种子轮

    Destro 结束隐身状态并获得 800 万美元种子轮融资,其 AI 智能层让机器人在物流场景中与人类协同作业。该公司在 Yusen Logistics 位于美国西北部的一处设施试点,用三台 Miva Robotics 搬运机器人配合 Vision 操作系统完成跨库装卸,现扩展至 26 台机器人部署,并在南加州启动 17 台机器人的新试点。

9月30日周三