跳到正文

#数据/训练

今日 35 条
8月27日周四
  1. NVIDIA dev blog robotics58

    NVIDIA 教程:如何用 AI 智能体训练跨本体机器人导航策略

    NVIDIA 发布技术博客,介绍如何用 AI 智能体训练跨本体机器人导航策略。文章指出导航不同于产生稳定运动的运动控制,需要持续定位、理解变化的环境、选择路线并避障以安全到达目标;把这一能力迁移到新机器人或新场景可能需要新的数据、仿真资产和机器人接口。

8月26日周三
  1. TechCrunch robotics38

    机器人“大脑”开发者正走出 GPT-2 时代:Actuate 大会与物理 AI 的数据困境

    为机器人构建 AI 大脑的开发者正试图复刻前沿 AI 实验室的路径,靠更多样数据集、不同训练方案和强化学习场景突破物理 AI 的“GPT-2 时代”。Foxglove 在 Actuate 大会上发布基于 Nvidia Cosmos 开放权重世界模型的新产品,支持用自然语言查询数据以加速评估与仿真。

  2. qbitai80

    Skild AI 发布机器人基础模型 S1,上下文学习支持 10 分钟长程任务

    北美具身初创 Skild AI 发布机器人基础模型 S1,主打上下文学习,无需后训练或微调,只看一段人类示范视频即可完成煎饼、冲泡咖啡、给植物换盆、设备组装等长程任务,上下文学习任务长度最长 10 分钟。

    推荐理由:Skild AI 的 S1 把机器人上下文学习拉到 10 分钟长程任务,并给出与语言提示 VLA 的成功率对比数据。

8月25日周二
8月24日周一
8月23日周日
  1. qbitai36

    具身创业里的香港教授们:至少十六位港校教授下场做机器人

    量子位梳理发现,至少十六位香港高校教授以创始人、联合创始人或首席科学家身份参与具身智能创业,方向覆盖世界模型、具身大脑、触觉灵巧手、手术机器人、无人叉车、无人机与自动驾驶。港大马毅联合创立忆生科技做自主学习世界模型,港科大王煜联合创办的戴盟机器人每平方厘米排布4万个感知单元,港大罗平参与的超维动力做117自由度人形机器人。港中大(深圳)贾奎的具身智能引擎公司估值已达百亿并冲刺上市。

  2. qbitai47

    共生知行押注双足人形端到端一体化大脑,团队全员博士在读

    共生知行正在研发双足人形机器人的端到端感控一体化「大脑」基座模型,其Demo中机器人全自主驾驶卡丁车连续过弯,实现手眼脚同步协同与多接触点平衡力控。团队由96年出生的丁鹏翔带领,核心成员均为00后博士在读,公司成立刚满两个月,押注纯端到端路线取代分层架构。

8月22日周六
  1. qbitai38

    硅羽科技张富:给无人机装上通用大脑,让空中智能体自主作业

    硅羽科技创始人张富(李泽湘学生、前大疆8年产业顾问、香港大学副教授)正把港大MaRS Lab的自主导航技术转化为产品,让飞行器不靠GPS和飞手遥控,自主感知、决策并完成任务。公司半年内连续完成四轮融资,累计数亿元,投资方包括耀途资本、锦秋基金、阿里巴巴。今年年底将量产第一阶段产品,面向地下管廊、隧道、仓储厂房、桥下与森林等场景,产品重量不到一千克、续航20-30分钟。

8月21日周五
  1. HF blog71

    τ_0-VLA:世界模型引导测试时计算的分层机器人基础模型

    τ_0-VLA 是一个分层视觉语言动作模型,把高层子任务生成建模为可扩展算力的推理问题,通过世界模型引导的测试时计算在需要时搜索备选子任务再输出。高层策略利用执行记忆生成子任务,低层策略在多种机器人本体上执行,模型基于 40,115 小时异构真实数据与多模态联合训练。在域内和分布偏移设置下,增加测试时计算量可提升下一子任务预测准确率,并转化为长时程操作任务的闭环成功率提升。

    推荐理由:论文提出用世界模型引导的测试时搜索为高层子任务决策分配更多算力,并给出跨本体与分布偏移下的闭环结果。

  2. qbitai78

    Generalist AI 发布机器人基础模型 GEN-1.5,看 3-12 秒示范即可学会新任务

    Generalist AI 发布机器人基础模型 GEN-1.5,主打 One-shot Learning,机器人看完 3-12 秒动作示范后无需梯度更新或微调即可执行新任务,还能把两段演示拼接成连续任务。

    推荐理由:GEN-1.5 把动作示范当作上下文提示,读者可据此了解机器人基础模型在少样本学习上的新路径。

  3. qbitai62

    千寻智能WRC重映整理客厅Demo:成功率与导航耗时30天内的变化

    千寻智能在2026世界机器人大会上重映了WAIC上做过的“整理客厅”长程任务Demo,并给出30天内的量化变化:可乐放入冰箱的自主推理成功率由约80%提升至99%以上,碗放入洗碗机由约90%提升至99%以上,导航目标确认耗时降低近50%,捡垃圾任务在颜色、种类、位置等泛化条件下执行成功率85%。

  4. HF blog62

    GOAG:面向灵巧操作的生成式物体无关抓取规划器

    GOAG 是一种物体无关的深度生成式抓取规划器,学习特定夹爪的接触面分布,无需物体特定训练数据即可为未见物体采样有效抓取。作者在仿真与真实场景的抓取协议上验证该方法,在 MultiDex 数据集上取得 86.93% 的平均成功率,生成大量抓取时处理速度明显更快,性能与专门在该数据集上训练的方法相当。代码与视频见项目网站 https://cea-list.github.io/goagweb/。

    推荐理由:论文提出与物体无关的抓取规划思路,读者可了解其如何用夹爪接触面分布替代物体特定训练数据。

8月20日周四
  1. qbitai60

    星海图 WRC 最大展台展示 G0.5 模型与生产力觉醒

    量子位在 2026 年 WRC 现场观察到,星海图以 500 平方米展台、10 组 Demo 展示其具身智能成果,主题为生产力觉醒。其与京东合作的前置仓场景中,机器人端到端完成下单、取货、打包与交付,背后 G0.5 模型据现场工作人员介绍可泛化到上万种 SKU;工业装配场景中引入强化学习后操作精度做到 1mm 以内、成功率 99.9%,效率提升 400%。

  2. qbitai60

    招商局狮子山人工智能实验室在WRC 2026演示LiOS端云协同叠衣方案

    招商局先进技术研究院下属狮子山人工智能实验室在2026世界机器人大会首次公开亮相,依托自研LiOS端云协同基础设施演示柔性衣物自主折叠方案。LiOS分云侧、端侧、端云协同三层,云侧支撑模型参数向百亿规模扩展,端侧接入异构本体与末端执行器,端云协同图传实现约30ms(网络部分24ms)本地相机到云端显存的单向端到端延迟。

8月19日周三
  1. qbitai22

    章鱼动力亮相WRC 2026,发布SYNWorld、OctoH-Hand与OctoSense“脑-手-数据”技术体系

    章鱼动力(SynapX)在2026世界机器人大会发布“脑-手-数据”技术体系,包括SYNWorld具身原生世界基础模型、OctoH-Hand高自由度仿生灵巧手和OctoSense下一代具身数采方案。OctoSense称全球首次实现肌电跨个体零样本泛化,让人类操作数据近乎无损对齐真机。公司三个月内获近10亿元融资,投资方包括地平线、高瓴创投、小米战投等。

  2. qbitai58

    源络科技Monte2人形机器人落地国家级科研实验室

    源络科技与国家级科研实验室联合研发的人形机器人Monte2已进入该实验室,可自主完成试剂取放、配置、分液、细胞毒性检测等流程,并协同多台实验设备运行。该机器人此前已在华大制造投入使用,实验室计划到2027年底将机器人数量扩展至约百台规模,并通过AI统一调度机器人集群。源络科技同时发起「原点计划」,寻找首批100位合作伙伴,共同验证具身智能在生物医药、材料科学、化学分析等领域的应用。

  3. HF blog78

    NeDM Study 4 数据集发布:宇树 Go2 在 CRM 颗粒地形上的神经降维动力学复现材料

    Hugging Face 上发布 NeDM Study 4 数据集,包含宇树 Go2 在 Chrono CRM 颗粒地形(SPH 颗粒土壤)上行走的语料、训练好的神经降维代理模型。

    推荐理由:论文配套数据集公开了宇树 Go2 在颗粒地形上的语料、代理模型与微调策略,可复现其仿真到真实迁移流程。

8月18日周二
8月17日周一
  1. qbitai40

    共生知行发布双足人形机器人驾驶卡丁车Demo,测试全身智能

    具身智能初创公司共生知行8月17日发布双足人形机器人驾驶卡丁车Demo,机器人在封闭赛道完成双手转向与脚部油门、刹车协调控制。公司将其定位为全身智能压力测试,探索从视觉感知到全身动作输出的端到端基座模型路线,后续将通过技术报告披露模型架构与评测方式。