跳到正文

全部动态

今日 71 条
9月15日周二
9月14日周一
  1. qbitai40

    首届蚂蚁灵波具身大模型挑战赛启动,基于 LingBot-VLA 2.0

    首届蚂蚁灵波具身大模型挑战赛在外滩大会启动,由蚂蚁灵波、魔搭社区和阿里云天池共同发起,以 2026 年 7 月开源的 LingBot-VLA 2.0 预训练模型为技术基座,面向全球开发者开放。大赛报名及线上初赛持续至 10 月 26 日,初赛设必做的 RoboTwin 2.0 仿真任务和可选真机创新任务,入围团队将于 11 月 13 日至 15 日在上海参加线下真机黑客马拉松。

  2. qbitai78

    生数科技发布世界模型 Motus2,探索机器人自我进化

    生数科技发布世界模型 Motus2,在同一模型中整合行动、预测与评估三种能力,形成生成动作、预测后果、评估结果、更新策略的闭环,探索递归自我改进(RSI)。真机测试中,手机放置与多指操作两项任务基础策略平均成功率 65%,加入规划为 67.5%,加入基于模型的强化学习为 72.5%,两者结合达 75%;加入触觉后抽取纸杯与撕纸任务平均成功率从 60% 提升至 72.5%。

    推荐理由:生数科技 Motus2 把动作生成、后果预测与价值评估放进同一世界模型,读者可了解其闭环自进化机制与真机数据。

  3. qbitai10

    2026崇礼论坛:AI生活方式、影像创作与下一代AI创造者

    2026崇礼论坛9月12日在崇礼·太舞小镇举行,以“未来此刻”为主题,参会嘉宾与观众超700人,由太舞小镇、甲子光年、破圈文化联合主办。论坛设置智能生活方式、Chongli AI Film Lab、AI Builders Show三个专场,并发布《2026AI生活方式白皮书》与2026「AI NEXT 20」榜单,同时启动首届崇礼AI短片节。

9月13日周日
  1. genesis releases30

    Genesis v1.4.1 发布:大幅提升大规模场景 CPU/GPU 性能

    Genesis 发布 v1.4.1,重点提升大规模场景下 CPU 与 GPU 的性能,速度随岛屿数量呈亚线性下降,不平衡场景的 Jacobi 均衡开销大幅降低,接触密集场景在 CPU 上明显加速。新版本支持不含 joint2 的 MJCF 关节等式,并修复 glTF 归一化整数访问器解码、法线与纹理坐标保留、MJCF 关节执行器力范围等问题。

9月12日周六
  1. qbitai78

    生数发布世界模型 Motus2,探索机器人闭环自进化

    生数科技发布世界模型 Motus2,在同一模型中整合行动、预测与评估三种能力,形成生成动作、预测后果、评估结果、更新策略的闭环,探索递归自我改进(RSI)。真机测试中,手机放置与多指操作两项任务基础策略平均成功率 65%,加入规划升至 67.5%,加入基于模型的强化学习达 72.5%,两者结合达 75%。

    推荐理由:生数 Motus2 把动作生成、后果预测与价值评估放进同一世界模型,读者可了解闭环自进化的实现路径与真机数据。

  2. TechCrunch robotics42

    Mecka AI 获红杉资本领投新融资,估值近 5 亿美元,专注机器人训练数据采集

    Mecka AI 正以约 5 亿美元估值完成红杉资本领投的新一轮融资,交易条款尚未最终确定。这家 2024 年成立的初创公司通过体感传感器和智能手机付费采集人们做咖啡、修车等日常任务的"自我中心"运动数据,用于训练人形机器人等机器人模型。此前三个月,它刚完成由 Framework Ventures 领投的 6000 万美元融资,并预计 2026 年底年化收入达 1 亿美元。

  3. HF blog41

    World in World:用世界模型探索世界,免训练实现相机与时间控制

    World in World 是一种免训练的推理时接口,让冻结的自回归视频世界模型支持灵活的相机与时间控制。它把源视频观测、目标视角场景投影、几何渲染和缓存外已生成状态等异构证据转为带相机与时间标签的干净视觉状态,通过原生自注意力读取,并用对应路由器和 EWA 逐通道调节注意力。同一冻结骨干可支持相机控制重渲染、长时程回访和人体动作迁移。

9月11日周五
  1. IEEE Spectrum robotics22

    人形机器人挑战猴杠:还能靠什么障碍逃脱它们?

    ETH Zurich 机器人系统实验室研究人形机器人猴杠穿越,机器人需跳上稀疏三维结构、通过稀疏横杆交互完成穿越并安全落地。宇树全面开源 UnifoLM-WLA-1.0 具身基础模型,称在多个基准上取得开源模型中的新 SOTA,单一模型可协调桌面与全身移动操作,支持跨任务和跨末端执行器泛化。

  2. qbitai38

    高德扫街榜2026全面AI化,空间智能引擎ABot-Earth 0.7亮相

    高德9月10日宣布扫街榜全面AI化,升级后的2026版用AI算法理解不同导航到店行为的评分权重。其空间智能核心引擎ABot-Earth 0.7被称为全球首个3D原生城市世界模型,仅需一张卫星图或一段文字,在消费级GPU上跑10分钟即可生成真实街景3D城市,效率比传统方法提升1000倍,已覆盖190多个国家、300多座城市。

  3. qbitai42

    九识完成“城市级物理AI”战略升级,推出九识租车并开放无人运力加盟

    九识9月10日在广州宣布完成“城市级物理AI”战略升级,推出“九识租车”小程序并开放无人运力加盟,同时与广汽领程、广州公交集团等签署合作协议。其RoboVan车队规模已超3万台,在全球300多座城市常态化运营,累计运营里程突破2.5亿公里。九识租车此前已在45座城市、300家客户中试点,累计完成1500+笔租赁订单,运行里程超100万公里。

  4. HF blog33

    SpatialBlock:用合成积木堆叠任务提升 LVLM 空间智能

    研究者提出 SpatialBlock,通过合成积木堆叠任务提升大型视觉语言模型(LVLM)的 3D 空间推理能力。其构建的 SpatialBlock-15k 数据集包含 15,000 个积木堆叠问题,覆盖 3D 到 2D 投影、视角变换和结构组合,并加入受控颜色调制作为视觉线索。实验显示,用该数据集训练的 LVLM 在直接回答和基于推理的预测两种方式下均显著优于基线,并能泛化到真实世界空间任务。

  5. TechCrunch robotics22

    TechCrunch 播客:机器人革命不会是人形机器人的革命,Mbodi 用自然语言教工业机器人

    Mbodi 联合创始人 Xavier Chi 在 TechCrunch 播客 Build Mode 中表示,机器人不会迎来单一的 ChatGPT 式突破,人形形态也非必要。Mbodi 用自然语言让人教工业机器人新技能,并与 ABB Robotics 合作进入工厂和仓库,近期在八小时测试中取得 99.6% 成功率。

  6. TechCrunch robotics35

    Mbodi 如何用自然语言教工业机器人,Xavier Chi 谈机器人规模化难题

    Mbodi 联合创始人 Xavier Chi 在 TechCrunch 播客 Build Mode 中介绍,其 AI 软件让人用自然语言教工业机器人新技能,并与 ABB Robotics 合作进入工厂和仓库。他透露 Mbodi 在八小时测试中达到 99.6% 成功率,并认为机器人不会出现单一的 ChatGPT 式突破,可靠性才是进入生产的关键。

  7. HF blog62

    论文提出 World Model RL,用世界模型加速自动研究智能体后训练

    论文提出 World Model RL(WMRL),用学习到的世界模型替代环境执行,以缓解自动研究智能体强化学习后训练中环境执行成为瓶颈的问题。作者进一步引入 Online Debiasing 与 Inverse-Variance Denoising 分别抵消世界模型奖励的偏差与噪声,并从理论上证明两者严格改善收敛保证。

    推荐理由:论文提出用世界模型替代环境执行来加速自动研究智能体的强化学习后训练,并给出理论收敛保证与跨任务迁移证据。

  8. NVIDIA blog robotics71

    Skild AI 发布 S1 机器人基础模型,单段视频即可学习新任务

    Skild AI 发布 S1 机器人基础模型,可用单段视频演示作为提示,在不更新权重、不做任务专项后训练的情况下执行此前未见的长程任务,最长约 10 分钟,涵盖装盆、做煎饼、手冲咖啡和套件装配等。

    推荐理由:S1 用单段视频提示完成长程任务且不更新权重,读者可据此判断免重训部署路径的可行边界。

9月10日周四
  1. Hackaday robots18

    揭秘 LUCAS 3 心肺复苏机器人:它真的能比人工按压救更多人吗

    LUCAS 3 是瑞典隆德大学研发的电动心肺复苏设备,以约 102 次/分钟、约 53 mm 深度对成人胸骨持续按压,替代人工胸外按压。4471 人的 PARAMEDIC 试验显示其 30 天生存率为 6.3%,人工按压为 6.8%,差异不显著;2589 人的 LINC 试验中 4 小时生存率分别为 23.6% 和 23.7%。

  2. qbitai62

    高德发布3D原生城市世界模型ABot-Earth 0.7

    9月10日,阿里巴巴集团旗下高德发布3D原生城市世界模型ABot-Earth 0.7,支持从星球到街景的一体化全尺寸AI生成,覆盖超过196个国家和地区。模型输入一张卫星图像或一段文字描述,可在消费级GPU上用10分钟生成公里级3DGS城市场景,效率比传统模式提升1000倍。体验官网已上线,相关能力已应用于飞行街景2.0,用户可操控摇杆漫游3D场景。

  3. qbitai71

    蚂蚁灵波开源1.3B轻量版LingBot-World 2.0,单卡可实时生成世界

    蚂蚁灵波发布LingBot-World 2.0轻量版,参数规模1.3B,面向消费级单卡GPU设计,可在本地实现实时世界生成。该版本延续7月开源的14B主模型路线,先训练Causal World因果预训练底座,再经一致性蒸馏与DMD蒸馏压缩去噪步数,并让Student在自身长时self-rollout轨迹上训练以减少累计漂移。

  4. qbitai57

    京东发布JoyAI-Echo WM世界模型,规划十万卡国产算力集群

    京东在JDD大会上发布实时可交互世界模型JoyAI-Echo WM,在WBench Navigation评测中以81.6分排名第一。京东云已与摩尔线程等打造国产万卡集群并规划建设十万卡集群,同时推进1000万小时具身数据采集,首批开源数据集EgoLive已对外开放。京东还启动物理AI加速计划,计划5年内采购300万台机器人、100万台无人车及10万架无人机。

  5. HF blog62

    用 HF Jobs 与 Storage Bucket 实现跨机 Async GRPO LoRA 训练

    Hugging Face 博客介绍如何用 AsyncGRPOTrainer 的 LoRA 适配器同步,在 HF Jobs 上把训练与 vLLM 推理拆到不同机器,通过挂载 Storage Bucket 传递几 MB 的 rank-1 适配器,无需 NCCL。

    推荐理由:原文给出跨机异步 GRPO 训练的可复用工程方案与五轮调优数据,读者可据此判断瓶颈定位与提速路径。