跳到正文

#感知/SLAM

今日 9 条
今天10月1日周四
  1. arXiv cs.RO39

    CGRAS:用机器人与计算机视觉自动监测珊瑚幼苗

    澳大利亚研究团队提出珊瑚培育机器人评估系统 CGRAS,结合机器人成像与计算机视觉,自动完成珊瑚多物种检测计数与健康评估,并提取生长、存活和空间分布指标。该系统在大型水产养殖设施的标准珊瑚附着基上验证,相比人工监测将时间和人力成本降低 9.6 倍,对 Acropora kenti 珊瑚的计数与专家结果一致率达 96.4%。

  2. arXiv cs.RO41

    FAST-Sync:面向任意矩阵李群的快速群同步方法

    FAST-Sync 是一种面向任意矩阵李群的快速线性近似群同步方法,可将弦初始化推广到任意矩阵李群,并利用问题数据矩阵的 Kronecker 积结构与同步图拓扑提升速度、可扩展性与精度。实验表明,该方法能为局部优化器提供高质量初始化,在测量噪声较大时仍高效恢复全局最优解并保持高成功率。

  3. arXiv cs.RO42

    基于对操作者推断的具身感知控制:一项仿真研究

    研究提出通用具身引擎(UEE),通过隐式注视与瞳孔信号及任务结果推断操作者的具身感和视本体线索权重,以离散主动推断智能体在显式偏好下选择有界设备设置。在300个异构合成操作者的仿真中,UEE多数在半分钟内找到合适设置,后半程具身感达1.68,接近预言机的0.73(0-2量表)。无模型赌博机表现更差,朴素预测误差最小化器会扣留反馈并降低任务成功率(0.74对0.90)。

9月30日周三
  1. arXiv cs.RO31

    MagNav:面向双轮机器人光照不变导航的双核磁轨引导框架

    MagNav 用五通道模拟霍尔效应传感器阵列实现双轮自平衡机器人的磁轨循迹,不受光照干扰。控制系统采用串级 PID:内环用 IMU 加互补滤波保持平衡,外环依据磁传感器读数调整转向,步进电机无需额外旋转编码器即可精确控制力矩。测试中磁引导在超过 10,000 Lux 强光下仍保持准确循迹,而对比的光学模块会失准甚至失效。

  2. HF blog28

    ReImaGin:用图像生成模型为多模态 LLM 做视觉推理

    Hugging Face 论文页介绍 ReImaGin,它把图像生成模型作为多模态 LLM 的灵活视觉推理机制,可接受自然语言指令执行去除遮挡、由多视角生成平面图等开放式视觉操作。在包含多视角空间推理与碰撞预测的六项视觉推理任务上,ReImaGin 持续优于纯文本推理和专用视觉工具基线,提升最高达 25%。

  3. HF blog38

    LeRF:学习参考坐标系以进行视角采择推理

    Hugging Face 发布 LeRF,让视觉语言模型在推理前显式确定提问所指的视角,必要时定位参考人或物体并预测其前、左、上方向,再用轻量工具在图像上画出坐标轴供模型作答。该方法通过监督微调学习坐标系预测与选择性工具调用,用强化学习学习基于自生成坐标系的推理,推理时无需外部感知模型或显式三维重建,在多个基准上提升了视角采择表现,包括想象视角问题。

9月20日周日
  1. IEEE Spectrum robotics28

    水下钙钛矿太阳能电池在10米深处实现34.71%光电转换效率

    云南大学张文华团队研制出钙钛矿太阳能电池,在模拟水下10米光谱条件下光电转换效率达34.71%,陆地条件下为17.08%。他们将电池封装后集成到水下迷你机器人上,在南海涠洲岛附近测试,10米深处115平方厘米电池两小时发电324毫瓦时,2米处为1416毫瓦时。研究估算电池在25°C水温下可连续运行约5.5年。

9月2日周三
  1. HF blog62

    Qwen-Drive-1.0:面向自动驾驶的视觉语言基础模型

    Qwen-Drive-1.0 是一个面向自动驾驶的视觉语言基础模型,在统一框架内整合 3D 感知、视觉问答与运动规划。模型保留预训练 VLM 架构,外接 BEV 感知头联合执行 3D 目标检测、语义占用预测和 BEV 地图分割,规划专家基于共享 VLM 表征生成未来自车轨迹。

    推荐理由:Qwen-Drive-1.0 把 3D 感知、视觉问答与运动规划统一在一个 VLM 框架内,并给出分阶段训练配方,可了解自动驾驶基础模型的构建思路。

8月31日周一
  1. Robohub38

    研究:人形机器人 Pepper 表现力越强,出错时人越不信任它

    一项发表于 Science Robotics 的研究让 50 人与商用人形机器人 Pepper 对话并共同决策,发现机器人出错会损害信任和影响力,无论它是否有表情动作。当富有表现力的 Pepper 打断对话或给出不合逻辑建议时,参与者催产素水平反而升高,且升得越高越不信任机器人、越少采纳其建议。脑成像显示,此时背外侧前额叶与内侧前额叶活动增强并协同更紧密,这一协同预测了催产素上升。

8月30日周日
  1. IEEE Spectrum robotics39

    印度团队研发低功耗可穿戴运动追踪系统,准确率超99%

    印度CSIR中央机械工程研究所团队在IEEE Sensors Journal发表研究,用6个可拉伸压阻传感器贴附于衣物髋、膝、踝处,配合微控制器上的机器学习算法,对12名受试者平地行走、上下坡和上下楼梯动作分类准确率达99.83%,未穿戴过该系统的新用户准确率为89%。整套传感层功耗仅0.318毫瓦,传感器可承受超过12000次拉伸至原长三倍的循环,目前仍为仅能分类动作的原型。

8月25日周二
8月6日周四
8月4日周二
  1. IEEE Spectrum robotics40

    中国团队研发钙钛矿激光充电接收器,为无人机空中持续供电

    中国民航大学与清华大学团队设计出基于钙钛矿的激光充电接收器,可让无人机在飞行中持续获电。该接收器面积2平方厘米,在5瓦绿光激光照射下实现近39%的光电转换效率,驱动6.7厘米螺旋桨达7820转/分;集成到固定翼模型后,螺旋桨以1200至1450转/分运转约一分钟。研究尚未进行空中飞行测试,团队下一步将开展轻量无人机的飞行验证。

7月28日周二
  1. IEEE Spectrum robotics62

    机器人指尖用彩色机械致变色皮肤实现高分辨率触觉感知

    伦敦玛丽女王大学等欧洲团队研发了一种机器人指尖,其合成皮肤通过布拉格反射器在受力变形时反射不同波长光,由内置摄像头读取颜色变化,生成拓扑、应变和接触压力图。该指尖实现100微米分辨率且无计算延迟,已用于生成人类指尖、硬币和叶片的形貌图。研究者称下一步希望提升对非平面物体的感知能力,并已与潜在应用企业接触。

7月23日周四
  1. Robohub46

    利兹大学 1.8 mm 磁控无压生长机器人获 RoboSoft 最佳论文奖

    利兹大学与加州大学圣地亚哥分校合作研发的 1.8 mm 软体生长机器人获 RoboSoft 最佳论文奖,该机器人通过磁控转向、无需内部气压即可生长,并能以最高 500 Hz 实时感知自身形状。其硅胶体内混入磁性颗粒并分区磁化,实现驱动与传感一体化,可同时生长和转向,有望减少微创手术中器械与组织的摩擦。

7月17日周五
  1. IEEE Spectrum robotics39

    西北大学 Phantom Twist 旋转无人机借视觉暂留实现近乎隐形

    西北大学在 RSS 2026 展示的 Phantom Twist 单电机旋转无人机,以 15 至 25 赫兹转速利用人眼视觉暂留,飞行时比同尺寸四旋翼难见约 10 倍。其设计经迭代优化器以 LPIPS 为指标生成,最优构型 LPIPS 为 0.0104,人工设计版本约 0.2。该机由 0.8 毫米碳纤维杆连接电机、电池、控制器与配重,目前依靠光学追踪系统控制。

7月8日周三
  1. HF blog39

    PointDiT:面向单目几何估计的像素空间扩散模型

    PointDiT 是一种基于普通 ViT 的极简像素空间扩散 Transformer,直接处理原始 3D 点图块,并以预训练 DINOv3 的图像 token 为条件,扩散主干完全从零训练,无需点图 tokenizer。它在单图 3D 重建上超越了复杂的潜空间扩散模型,同时比混合架构更简单,几何结构更锐利,在透明物体等高度歧义区域更稳健。

7月7日周二
  1. IEEE Spectrum robotics40

    受大脑启发的图像传感器:可感光、可记忆、可渐忘

    俄勒冈州立大学团队研发出一种受大脑启发的光电晶体管图像传感器,能同时感光并存储数据,还可通过电压调节记忆时长,实现从快速遗忘到保留数小时的渐变遗忘。该器件为4×4像素阵列,采用IGZO晶体管与有机光活性层,可在传感器上直接完成变化检测,有望大幅降低机器视觉的能耗。目前仅完成器件级验证,下一步将扩展像素阵列并开发集成成像原型。

5月28日周四
5月27日周三
  1. Robohub60

    康奈尔大学研发软体夹爪,靠触觉判断草莓成熟度并轻柔采摘

    康奈尔大学研究团队用可拉伸光纤传感器制作软体机器人夹爪,通过触觉预测草莓成熟度,并轻柔地将果实从藤蔓上旋拧摘下而不造成损伤。夹爪装有两种光纤传感器,分别测量手指弯曲度和指尖压力,据此估计物体形状并调整抓握力度;腕部还加入行星齿轮机构,使夹爪旋转拧下果实而非拉扯。

5月18日周一
11月5日周三