krish5831/act_tissues_into_box:基于 ACT 与 LeRobot 的纸巾入盒策略
Hugging Face 上发布了一个名为 krish5831/act_tissues_into_box 的 ACT 模仿学习策略,用 LeRobot 0.6.2 训练,可让 so_follower 机器人完成“把纸巾包放进盒子”的任务。
Hugging Face 上发布了一个名为 krish5831/act_tissues_into_box 的 ACT 模仿学习策略,用 LeRobot 0.6.2 训练,可让 so_follower 机器人完成“把纸巾包放进盒子”的任务。
Hugging Face 上发布 bk912/dp_green_cube_to_box_finetune_20k,这是一个用 LeRobot 0.6.2 训练的扩散策略(Diffusion Policy),在 so_follower 机器人上执行“从蓝色平台拿起绿色方块放入盒子”任务。
Hugging Face 上线数据集 jayantrathi/lang_grasp_v1,由 LeRobot 生成,采用 v3.0 数据格式,含 91 条 episode、44598 帧、3 个任务,机器人类型为 so_follower。数据以 30 fps 采集,动作与状态均为 6 维关节位置(含 gripper.pos),并配 480×640 前置视频,训练集划分为 0:91。
ROBOTIS 发布 Mission Canvas,可在地图上定义航点并指定顺序,为每个位置关联一个 Task,使导航与机器人动作作为单个 Mission 执行。
Hugging Face 上线数据集 ngustj/pen_pick_place_clean_150ep_v1,用 LeRobot 采集,共 150 个回合、71019 帧,30 fps,机器人类型为 so_follower。该数据集含 1 项任务,动作与状态均为 6 维关节位置,另配 top 和 wrist 两路 480×640 视频,采用 v3.0 代码库格式,训练集覆盖全部 150 个回合。
Hugging Face 上线数据集 wcxhimself/KIVI-Generated-Videos,页面仅标注其属于 Datasets 类别,未披露视频数量、生成模型、分辨率或授权等具体信息。该数据集以开源开放科学为背景发布。
Hugging Face 上线数据集 Aaaay-0610/so101-task-1,由 LeRobot 生成,采用 codebase_version v3.0,含 75 条 episode、35614 帧、1 个任务,机器人类型为 so_follower。
Hugging Face 上线数据集 izlley/h101_multi_v1,由 LeRobot 生成,含 100 条 episode、49490 帧、3 个任务,机器人类型为 bi_so_follower。数据以 30 fps 记录 12 维双臂关节与夹爪动作及状态,并含左腕、头部、右腕三路 480×640 AV1 视频。
Hugging Face 上线 LeRobot 数据集 zhniu/lerobot_zihao_dataset_a_20260927_202323,含 40 个 episode、12000 帧、1 个任务,机器人类型为 so_follower。
Hugging Face 上发布 Taisanson/welding-seam-following 焊缝跟踪数据集,由 LeRobot 构建,采用 v3.0 数据格式,共 40 条 episode、33560 帧、1 个任务,机器人类型为 so_follower。
Hugging Face 上线数据集 Fabyo04/so101_cube_demo_0_20260926_155239,由 LeRobot 生成,机器人类型为 so_follower,共 100 条 episode、44553 帧、1 项任务,采用 v3.0 代码库、30 fps。
Hugging Face 上出现一个用 LeRobot 创建、代号 my_pick_test_color 的机器人抓取数据集,采用 v3.0 代码库版本,共 30 条 episode、6750 帧、1 个任务,机器人类型为 so_follower。
Hugging Face 上线 mim-chess-vlas 数据集,基于 LeRobot v3.0 构建,含 787 段、195184 帧 Panda 机器人仿真演示,覆盖 40 项任务,20 fps,状态为 9 维、动作为 7 维,含 agentview 与两路 eye-in-hand 相机视频。
armand0e/MiMo-V2.6-Distill-Qwen-9B-RL 已在 Hugging Face 上线,页面归类于 Models。该条目位于 Hugging Face 的模型、数据集、Spaces 等资源导航中,正文未披露模型参数、训练方法或评测结果等更多细节。
Hugging Face 上线数据集 mim-chess-vlas/train_800_complex__mask__blackout__sim__all_cameras__live__depth,含 790 条 Franka Panda 仿真演示、共 157,904 帧,任务是把被两条扁平弧形臂夹住的圆球放入盒子。
Google 旗下 AI 机器人团队 Intrinsic 宣布将平台部分能力开源,推出 Intrinsic Core,一套兼容 ROS 的机器人应用开发能力集。
Hugging Face 用户 Tenry55 发布机器人数据集 Pick_and_put_screw_driver_with_variance,任务为把红色螺丝刀放进灰色袋子。
Hugging Face 上线 leoliu49/pick-cap-tactile 数据集,用 SO-101 的 so_follower 本体采集“抓住瓶盖,抓空就重试”任务。
Hugging Face 上线机器人数据集 leoliu49/pick-cap-notactile,含 39 条 SO-101(so_follower)示范,任务为“抓住瓶盖拿起瓶子,没抓中就重试”。
QERRA-v2 Classical 发布 Webots Demo 6,在 PAL Robotics TIAGo 上演示 Layer 1 物理安全反射 QERRA-HSR v0.1。
ros2_unbag 从 v1.3.0 起通过官方 ROS 2 buildfarm 发布,可直接用 sudo apt install ros-<distro>-unbag 安装,无需 pip、克隆或源码编译。该工具用于将 ROS bag 导出为图像、视频、点云、CSV、JSON/YAML 及自定义格式,支持并行提取、话题过滤、结构化输出和 CLI/GUI 工作流。
Genesis 发布 v1.4.2,通过休眠机制让休眠岛屿不再产生运行时开销,并加速了启用休眠的刚体仿真与大规模接触岛屿的 GPU 刚体求解器。该版本还改进了 Signorini 接触求解的收敛性,但因收敛问题仍属实验性功能。此外修复了约束求解退出时阻尼关节注入能量的问题,并暴露场景步进各阶段的墙钟时间。
DENSO 机器人 ROS 2 stack 新增 VS-050 支持、MoveIt Servo 与双 VS-050 同时操作,并更新至 Gazebo Fortress(Humble),同时推出包含上述改动的 ROS Jazzy 版本。
开发者对机器人行为树执行守卫 QERRA-v2 Classical 开展 20 例对抗基准测试,在 Webots 仿真中用 PAL Robotics TIAGo 验证。
第三方公益机构 Robocurve 发布机器人安全基准 RoboHarm,把 GPT-6 Astra、Fable 5.1 和 MolmoAct2 接入同一套双机械臂,测试刺向类人目标、加热压缩气体、制造有毒烟雾等五类物理风险任务,每任务每模型重复 20 次并由人工打分。
清华大学、无问芯穹、正行创新联合开源具身智能体基础设施 RPent,将通用大模型的任务规划、VLA 等专家模型的动作执行与记忆系统连接成闭环,在 LIBERO-PRO 基准达到 92.6% 任务成功率。
推荐理由:RPent 把大模型规划、VLA 执行与记忆机制串成闭环,并给出 LIBERO-Pro 成功率与 Flash Mode 延时数据,可据此判断分层智能体路线的工程取舍。
社区独立项目 CPM-jev 发布 v0.1-research-preview,这是基于 openbmb/MiniCPM5-2B-Base 的 LoRA 微调模型,新增决策头为候选动作打分并归一化为概率分布。
Hugging Face Hub 上线 K-vr/cube_stack3_Pi05_abs_batch8,这是基于 Physical Intelligence 的 π₀.₅ 视觉语言动作模型、用 LeRobot 0.6.1 微调并推送的机器人策略,基座为 lerobot/pi05_base。
Qyvos 是基于 SupersonicLabs/Julia-1 仅微调决策头得到的决策/分类模型,在 ZefanCai/Open-Jev 数据集上训练,支持 choice、score、noul 三类决策。模型冻结 ModernBERT-small 编码器与动作头,仅训练 3,699,073 个参数(占 2.56%),在 3.9 GB 内存约束下完成 3,750 步训练。
PhAI Labs 联合牛津、斯坦福、普林斯顿、港中文等团队发布技术报告 JEPA-Anything,提出面向不同领域学习预测模型的跨领域框架,各领域保留自己的观测形式与编码器,共享预测核心和统一的 latent world-state interface。
Hugging Face 论文页发布 FAMOS,一个从稀疏无序部分点云预测可动部件分割与关节参数的前馈模型,支持包括单视图在内的可变数量输入。它提出 Multi-state Articulation Transformer,以交替的状态级与全局注意力聚合多观测关节线索,并引入观测关节跨度目标监督各部件在输入观测中的运动范围。
MoveIt 2 发布 2.15.2 版本,由 nbbrooks 于 9 月 16 日打标签。该版本在 GitHub 上提供 2 个资源文件下载,仓库现有 2k 星标、810 次 fork。
无问芯穹联合清华大学、上海交通大学开源具身智能端侧推理引擎 APXInf,支持 RTX 4090、Jetson Orin、Jetson Thor 等平台,首发支持 PI 0.5 与 WALL-OSS 两款具身模型。
Genesis 发布 v1.4.1,重点提升大规模场景下 CPU 与 GPU 的性能,速度随岛屿数量呈亚线性下降,不平衡场景的 Jacobi 均衡开销大幅降低,接触密集场景在 CPU 上明显加速。新版本支持不含 joint2 的 MJCF 关节等式,并修复 glTF 归一化整数访问器解码、法线与纹理坐标保留、MJCF 关节执行器力范围等问题。
Hugging Face 论文页介绍 Recursive Code World Models(RCWM),一种从单张参考图像以可执行代码递归重建复杂 3D 世界的框架。
研究者提出 SpatialBlock,通过合成积木堆叠任务提升大型视觉语言模型(LVLM)的 3D 空间推理能力。其构建的 SpatialBlock-15k 数据集包含 15,000 个积木堆叠问题,覆盖 3D 到 2D 投影、视角变换和结构组合,并加入受控颜色调制作为视觉线索。实验显示,用该数据集训练的 LVLM 在直接回答和基于推理的预测两种方式下均显著优于基线,并能泛化到真实世界空间任务。
蚂蚁灵波发布LingBot-World 2.0轻量版,参数规模1.3B,面向消费级单卡GPU设计,可在本地实现实时世界生成。该版本延续7月开源的14B主模型路线,先训练Causal World因果预训练底座,再经一致性蒸馏与DMD蒸馏压缩去噪步数,并让Student在自身长时self-rollout轨迹上训练以减少累计漂移。
Zenoh 发布 1.10.1,为 TransportUnicast API 新增 close_link 方法。该版本修复了回环定位器的 gossip 探测、REST 插件从编码中提取 content-type HTTP 头,以及空 scout 定位器下待处理连接未清除的问题。
Genesis 发布 v1.4.0,支持将场景连同完整轨迹导出为独立归档,可在任意机器上通过 gs replay 实现位精确回放,目前仅支持刚体求解器。该版本还新增在内存中保存与恢复已构建场景、在连杆任意局部点施加外部力旋量,并修复了大量与资产解析相关的缺陷。
Hugging Face 上线数据集 trinity-graphics/truncgradgs,页面仅附 Hugging Face 推进开源与开放科学的使命宣言,未披露数据规模、模态、许可或使用方式等细节。