跳到正文

全部动态

今日 71 条
9月30日周三
  1. HF blog38

    Hugging Face 发布 Sys1Cal-v1 数据集:评估 Jev 等结构化概率输出的校准问题

    Hugging Face 发布 Sys1Cal-v1 基准数据集,用于直接评估结构化概率输出而非仅检查预测类别的置信度。在 Jev 上测试发现,Noul 和 Score 的概率接近真实值,而二元 Choice 输出存在系统性非线性失真,可通过引入潜在第三分量 Uncertain 建模。数据集与评估代码已公开,支持在其他结构化决策模型上复现。

  2. HF blog65

    EVO-WAM:通过视频动作验证演化世界动作模型

    EVO-WAM 提出一种让世界动作模型(WAM)在无需额外专家示范、也不在外部环境执行候选动作的情况下适配新任务的框架,通过状态预测与锚定多帧上下文实现完整自回归 rollout,并用视觉语言模型筛选完成任务的前缀、用逆动力学模型验证视频与动作一致性,再迭代训练。

    推荐理由:论文给出无需额外专家示范、靠自生成视频动作轨迹适配新任务的框架,并附仿真与真机成功率数据。

  3. HF blog66

    CrossBFM:跨人形本体蒸馏共享潜行为空间

    CrossBFM 提出无机器人专属参数的统一编码器架构,借助重定向提供的帧级跨本体对应关系,将行为基础模型的潜空间蒸馏到多个训练本体上,耗时不到一 GPU 小时。

    推荐理由:CrossBFM 把行为潜空间当作可迁移资产,用不到一 GPU 小时蒸馏出跨本体共享空间,读者可据此了解人形策略迁移的训练成本变化。

  4. HF blog38

    LeRF:学习参考坐标系以进行视角采择推理

    Hugging Face 发布 LeRF,让视觉语言模型在推理前显式确定提问所指的视角,必要时定位参考人或物体并预测其前、左、上方向,再用轻量工具在图像上画出坐标轴供模型作答。该方法通过监督微调学习坐标系预测与选择性工具调用,用强化学习学习基于自生成坐标系的推理,推理时无需外部感知模型或显式三维重建,在多个基准上提升了视角采择表现,包括想象视角问题。

  5. HF blog80

    EWAM 发布统一具身模型:单一扩散 Transformer 联合处理视觉语言、未来视频与动作

    EWAM 是一个统一具身模型,在单个 flow-matching Diffusion Transformer 中联合处理视觉语言、未来视频和动作 token,无需显式阶段设计即出现按深度分工:浅层从视觉语言专家取指令与当前场景语义,中层转向预测的未来帧表示,深层由动作自注意力主导做运动细化。

    推荐理由:EWAM 把视觉语言、未来视频与动作 token 放进同一扩散 Transformer,并公开各阶段权重与下载方式,便于对照其分层分工与基准结果。

9月29日周二
  1. ROS Discourse latest8

    ROS 海事工作组 9 月会议提醒:OCEANS 2026 回顾与仿真方向讨论

    ROS 海事工作组例会于 9 月 29 日 4pm EST 举行,回顾 OCEANS 2026 并讨论海事组在仿真工作上的投入方向,Chris Thierauf 还介绍了其近期发布的语言无关规范 beta 版。会议固定在每月最后一个周二 4–5pm EST,会前建议填写 Open Ocean Software 调查问卷,其结果持续影响工作组方向与社区机会。

  2. qbitai22

    正行创新联合创始人杨宇欣出任总裁,负责全球业务拓展

    正行创新(Striding AI)联合创始人杨宇欣正式亮相并出任公司总裁,全面负责全球市场拓展、产业生态建设与商业化落地。他此前在黑芝麻智能担任首席市场营销官八年,亲历其首款产品发布、量产到港股上市,更早曾在中科创达任董事及副总裁。正行创新成立于2026年初,由姚颂、正大集团、于超联合发起,通过世界动作模型与强化学习技术推动人形机器人部署至真实商业与工业场景。

  3. HF blog22

    castanetnicolas 的 ACT UR5e 方形螺母装配策略上线 Hugging Face

    Hugging Face 上发布了一个基于 ACT(Action Chunking with Transformers)的 UR5e 模仿学习策略,用 LeRobot 0.6.1 训练,任务是把方形螺母装到方形销上。该策略使用 100 条遥操作数据(24602 帧、20 FPS)训练 10 万步,输入两路 84×84 图像和 9 维状态,输出 7 维动作,目前尚未提供评测结果。

  4. Open Robotics blog12

    Open Robotics 启动 2026 年度调查,面向所有机器人从业者与爱好者

    Open Robotics 启动首届年度调查,面向所有机器人从业者、学生和爱好者,无论是否使用 ROS、ros-controls、Space ROS、Gazebo、Open-RMF 等 Open Robotics Suite 软件均可参与。调查截止 2026 年 11 月 30 日,完成后可留下邮箱参与抽奖,随机抽取 50 名参与者,奖品为 Open Robotics Store 中任选一件商品。

  5. qbitai47

    诺因智能完成数亿元天使+++轮融资,GLOW 大模型与 KNOWIN-X1 推进量产准备

    消费级具身智能公司诺因智能完成数亿元人民币天使+++轮融资,由京东相关基金领投,正心谷资本、南山战新投和华登投资跟投,成立以来累计融资超10亿元。资金将用于扩充GLOW生成式具身大模型训练数据、推进KNOWIN-X1本体工程验证与量产准备。GLOW在RoboDojo的18项仿真任务中平均成功率62.2%,在LIBERO-Pro以86.7%位列所列单策略模型第一。

  6. qbitai82

    AMD以82亿美元全股票收购李飞飞World Labs,李飞飞将任首席科学家

    AMD宣布以82亿美元全股票收购李飞飞创办的空间智能公司World Labs,交易预计2026年底前完成,仍须取得监管批准。交割后李飞飞将加入AMD担任执行副总裁兼首席科学家,直接向苏姿丰汇报,联合创始人Justin Johnson和Ben Mildenhall继续带领团队并入AMD。

    推荐理由:梳理AMD收购World Labs的交易结构、技术合作脉络与各轮投资人回报,可看清芯片巨头布局空间智能的路径。

  7. HF blog60

    strands-robots 用 Isaac Lab 训练宇树 Go2 并录制 LeRobot 数据集

    strands-robots 通过 isaaclab train_policy provider 在 Isaac Lab 中训练宇树 Go2 四足机器人 PPO 策略,4096 个并行环境、1500 次迭代、147M 环境步,在单张 NVIDIA L40S 上耗时 57 分 39 秒,速度跟踪成功率 0.98。

    推荐理由:原文给出从 Isaac Lab 训练 PPO 策略到录制 LeRobot v3 数据集的完整命令与验证流程,可迁移到其他机器人任务。

  8. HF blog62

    strands 发布 Isaac Lab Shadow Hand 手中方块重定向 PPO 策略

    cagataydev 在 Hugging Face 发布 strands-isaaclab-shadow-reorient-policy,这是用 strands-robots 的 isaaclab train_policy provider(PR #4227)训练的 rsl_rl PPO 策略,任务为 Isaac-Reorient-Cube-Shadow 手中方块重定向。

    推荐理由:读者可据此了解用 strands 工具链在 Isaac Lab 中训练并导出 Shadow Hand 转方块策略的完整流程与实测指标。

  9. HF blog62

    JapaneseTinyAgentLM-Action-3M 发布:3.1M 参数模型在 ESP32-S3 上把日语指令转为机器人动作 JSON

    ayousanz 发布 JapaneseTinyAgentLM-Action-3M,一个 3,148,608 参数的 decoder-only Transformer,把日语短指令转成 look、set_expression、nod 三类动作的 JSON 数组,非指令或无法执行的请求返回空数组。

    推荐理由:3.1M 参数模型在 ESP32-S3 上本地把日语指令转成动作 JSON,附完整评测与误差区间,可看端侧具身控制的可行边界。