跳到正文

全部动态

今日 71 条
7月12日周日
  1. qbitai62

    量子位梳理97家具身数据玩家:一年融资44.7亿,谁真能靠卖数据赚钱

    量子位不完全统计97家国内具身数据玩家,其中70家做数据采集、27家做数据infra,并总结出十条行业现状。过去一年(2025年7月1日至2026年7月1日),15家不做本体、不做模型、只做数据的独立具身数据服务商共完成34起融资,合计约44.7亿元,其中光轮智能一家融资31亿元、最新估值超20亿美元。

  2. Hackaday robots22

    Kindalive 用八种神经化学物质模拟机器人面部情绪

    Drew Smith 发布纯 Python 项目 Kindalive,用多巴胺、皮质醇等八种神经化学物质的模拟衰减与相互作用实时推导情绪状态,而非用大语言模型给文本打离散标签。它通过调整 FACS 面部动作编码系统中的十二种面部动作,驱动点阵机器人脸表达短期与长期情绪,也可用于真实 LED 矩阵或动画脸舵机。

7月11日周六
  1. genesis releases38

    Genesis v1.2.2 发布:新增高吞吐触觉传感器系列,非凸碰撞检测更稳健

    Genesis 发布 v1.2.2,新增面向强化学习灵巧策略训练的高吞吐真实触觉传感器系列,并支持迟滞、失效触觉单元、探针增益等噪声选项。非凸碰撞检测鲁棒性提升,性能与凸分解相当,修复了虚假深层接触与薄壳穿透问题;启用 noslip 后处理对所有后端的减速降至 20% 以内。

  2. Hackaday robots22

    OpenCat 机器狗浏览器模拟器上线

    OpenCat 机器狗现可在浏览器中免费模拟运行,代码基于 Web IDE,主文件简洁,核心逻辑位于 src/moduleManager.h 的 read_serial 和 src/reaction.h 的 reaction 中。用户可通过模拟器按钮或串口命令(如 ksit 让狗坐下)控制,支持修改代码并编译后在虚拟机器人上运行。该机器人支持加装简单传感器或更换头部为机械臂,但传感器配置有限。

  3. ROS Discourse latest17

    ROS 周报:ROSCon 早鸟票、Gazebo 仿真工具链与 PlotJuggler 4.0

    ROS 官方发布 7 月 6 日当周周报,提醒 7 月 12 日是 ROSCon Global 早鸟票最后购买日。本周推荐了可用免费卫星影像和 DEM 数据生成仿真世界的 Gazebo 工具链、支持发送指令且可 pip 安装的机器人数据可视化界面 RUBI,以及支持时序、2D/3D/4D 数据并可通过 AppImage 安装的 PlotJuggler v4.0。

7月10日周五
  1. IEEE Spectrum robotics34

    廉价地面机器人如何改写乌克兰前线战争

    乌克兰RoverTech公司CEO Borys Drozhak称,其Zmiy无人地面车辆(UGV)平均能在杀伤区完成57次任务才被摧毁,而多数UGV仅能存活约7次。Zmiy重800公斤、尺寸2.15×1.5米,可配置为排雷、后勤、灭火、机枪射击或榴弹发射等型号。乌克兰总统泽连斯基已下令在2026年底前采购5万套UGV,是2025年采购量的三倍多。

  2. qbitai78

    蚂蚁灵波发布 LingBot-VA 2.0 具身原生预训练 VA 基座模型

    蚂蚁灵波发布 LingBot-VA 2.0,称其为全球首个具身原生预训练 VA 基座模型,从架构、数据到训练目标均为机器人定制。模型采用因果 DiT 加稀疏 MoE 主干,视频主干总参数约 13B、推理激活约 1.9B,训练参数量约 15.3B、每 token 推理激活约 2.5B。

    推荐理由:蚂蚁灵波 LingBot-VA 2.0 从架构到训练目标均为机器人定制,读者可了解具身原生 VA 基座的设计取舍与实测数据。

  3. HF blog60

    AlayaWorld:长时程可交互视频世界生成框架开源

    AlayaWorld 是一个开源全栈框架,用于构建可实时交互的生成式世界,支持自由导航及战斗、施法、召唤怪物等多样动作。该框架统一了数据准备、模型架构、训练、推理加速与部署,并开源可复现管线、参考实现、评测工具与文档。论文称其基于游戏录像和真实视频训练,可捕捉多样视觉外观与物理动态,为游戏之外的具身智能等交互应用提供机会。

    推荐理由:论文给出可复现的视频世界模型全栈框架,读者可了解其模块化架构与开源管线如何支撑实时交互生成。

  4. HF blog71

    RynnWorld-Teleop:面向数字遥操作的动作条件世界模型

    论文提出 RynnWorld-Teleop,一种动作条件世界模型,用生成式世界模型替代实体机器人实现数字遥操作,将操作者手部姿态流转化为机器人视角的高保真视频,并作为与本体无关的动作标签经重定向迁移到任意目标机器人。

    推荐理由:论文提出用生成式世界模型替代实体机器人采集数据,读者可了解数字遥操作如何解耦硬件约束并生成可迁移轨迹。

  5. HF blog71

    RynnWorld-4D:面向机器人操作的 4D 具身世界模型

    RynnWorld-4D 是一个多模态 4D 世界模型,可从单张 RGB-D 图像和语言指令出发,在统一扩散过程中同步生成未来的 RGB 帧、深度图和光流。其三分支架构结合跨模态注意力与逐帧 3D RoPE,并配套超过 2.544 亿帧的 Rynn4DDataset 1.0 数据集。

    推荐理由:论文提出用同步 RGB、深度与光流构建 4D 世界模型,并给出策略头与大规模数据集,可供世界模型与操作研究者参考。

7月9日周四
  1. qbitai74

    蚂蚁灵波开源 LingBot-Video 具身视频模型

    蚂蚁灵波开源 LingBot-Video,称其为面向具身智能的大规模 MoE 视频基础模型,采用 30B 参数、推理时激活约 3B。模型引入超 70000 小时具身相关视频,覆盖机器人操作、导航与第一视角等场景,并加入物理合理性、任务完成度等多维奖励。团队称其在 RBench 上超过通用视频生成标杆模型,并已在 TI2V 任务的开源竞品中达到 SOTA。

  2. qbitai22

    量化派物理AI:从餐饮后厨验证到物理世界基础模型,走卖能力的路

    量化派近期在餐饮后厨完成四轮具身智能技术验证,覆盖三明治柔性制作、购物袋自主分拣、牛排跨抽屉找盐调味和奶茶跨设备协同,均落地真实动态工况。其定位为跨场景、跨本体的开放生活场景世界模型提供商,不绑定硬件,主张让机器人从「动作自动化」迈向「任务级自主作业」,并以RaaS按效用付费模式切入。

7月8日周三
  1. qbitai22

    2026世界机器人大会8月19日北京亦庄举行:主题“人机共生,产需共融”

    2026世界机器人大会将于8月19日至23日在北京经济技术开发区举行,主题为“人机共生,产需共融”。博览会参展企业300余家、较去年增加36%,预计展品超2000件、首发新品150余件,同期活动60余场。大会将发起“全球机器人应用探索计划”,国务院国资委将现场宣布成立中央企业机器人创新联合体。

  2. qbitai20

    WAIC 2026 将于7月17日至20日在上海举行并首发主题片

    2026世界人工智能大会暨人工智能全球治理高级别会议将于7月17日至20日在上海世博、张江、西岸"三地四馆"举行,主题为"智能伙伴 共创未来",并首发主题片。大会策划140余场论坛,展览总面积首次突破10万平方米,1100余家企业参展,超300款产品将全球首发。上海2025年规上人工智能企业394家,产业规模超6370亿元,同比增长39.5%。

  3. qbitai80

    蚂蚁灵波开源 LingBot-VLA 2.0,6 万小时数据支持 20 多种机器人

    蚂蚁灵波发布并开源通用 VLA 模型 LingBot-VLA 2.0,预训练数据达 6 万小时,其中 5 万小时来自覆盖 20 种机器人构型的真机轨迹数据,1 万小时来自第一视角人类操作视频。

    推荐理由:蚂蚁灵波开源 LingBot-VLA 2.0,读者可了解其 6 万小时数据规模、20 种本体覆盖及 GM-100 对比结果。

  4. qbitai78

    蚂蚁灵波开源LingBot-VLA 2.0,支持17家厂商20种机器人构型

    蚂蚁灵波科技7月8日宣布升级并开源具身基座模型LingBot-VLA 2.0,预训练融入6万小时真实物理数据,覆盖17个机器人品牌的20种构型,并扩展对头部、腰部、末端执行器及移动底盘等自由度的支持。

    推荐理由:原文给出预训练数据规模、支持构型与双臂及移动操作评测对比,可据此判断跨构型VLA基座的落地进展。