跳到正文

#仿真/Sim2Real

今日 33 条
9月30日周三
9月29日周二
  1. HF blog60

    strands-robots 用 Isaac Lab 训练宇树 Go2 并录制 LeRobot 数据集

    strands-robots 通过 isaaclab train_policy provider 在 Isaac Lab 中训练宇树 Go2 四足机器人 PPO 策略,4096 个并行环境、1500 次迭代、147M 环境步,在单张 NVIDIA L40S 上耗时 57 分 39 秒,速度跟踪成功率 0.98。

    推荐理由:原文给出从 Isaac Lab 训练 PPO 策略到录制 LeRobot v3 数据集的完整命令与验证流程,可迁移到其他机器人任务。

  2. HF blog62

    strands 发布 Isaac Lab Shadow Hand 手中方块重定向 PPO 策略

    cagataydev 在 Hugging Face 发布 strands-isaaclab-shadow-reorient-policy,这是用 strands-robots 的 isaaclab train_policy provider(PR #4227)训练的 rsl_rl PPO 策略,任务为 Isaac-Reorient-Cube-Shadow 手中方块重定向。

    推荐理由:读者可据此了解用 strands 工具链在 Isaac Lab 中训练并导出 Shadow Hand 转方块策略的完整流程与实测指标。

9月28日周一
9月26日周六
9月25日周五
9月24日周四
  1. genesis releases22

    Genesis v1.4.2 发布:通过休眠机制提升大规模场景性能

    Genesis 发布 v1.4.2,通过休眠机制让休眠岛屿不再产生运行时开销,并加速了启用休眠的刚体仿真与大规模接触岛屿的 GPU 刚体求解器。该版本还改进了 Signorini 接触求解的收敛性,但因收敛问题仍属实验性功能。此外修复了约束求解退出时阻尼关节注入能量的问题,并暴露场景步进各阶段的墙钟时间。

9月23日周三
9月22日周二
  1. NVIDIA blog robotics78

    NVIDIA 发布 Isaac ROS 5.0,支持 ROS Lyrical 与 agentic 开发工作流

    NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,新增对 ROS Lyrical 和 Ubuntu 24.04 的支持,并引入面向 AI agent 的 setup、manipulation 等可复用技能与 agent-ready 文档。

    推荐理由:Isaac ROS 5.0 的 agentic 工作流与 ROS Lyrical、Ubuntu 24.04 支持,为开发者提供了从开发到 Jetson 部署的完整路径参考。

  2. ROS Discourse latest40

    从 CT 扫描到机器人手术原型:ROS 2 中的肾结石检测与 PCNL 规划

    一个研究原型打通了医学 CT 影像与 ROS 2 可视化及机器人仿真:从 DICOM/NIfTI CT 扫描出发,用 TotalSegmentator 分割左右肾及邻近器官,以高 HU 阈值加连通域提取结石候选,生成毫米级 3D 网格,再规划并排序 PCNL 经皮肾镜取石通道,在 RViz 和 Gazebo 中用带穿刺针的 Franka FR3 复现所选路径。

9月21日周一
  1. HF blog62

    Learning Foresight without Explicit Trajectories for 3D Diffusion Policies 论文发布

    论文提出 Movement Trend Guidance,让 3D 扩散策略从短观测历史中学习交互演化的紧凑隐表示,训练时用稀疏未来夹爪状态监督,推理时仅保留该隐表示作为未来导向条件。

    推荐理由:论文提出 Movement Trend Guidance,用隐变量为 3D 扩散策略提供交互走向的前瞻信息,并给出多基准对比数据。

9月20日周日
  1. Hackaday robots55

    ETH Zurich 让机器人手用手指行走

    ETH Zurich 研究人员把一只商用机器人手改造成能用手指行走的装置,为其加装电池和 Raspberry Pi Zero 2 W,并开发神经网络控制软件。该手有 20 个关节、每指 4 个,网络根据先前动作、手部状态和当前目标迭代输出下一关节状态;训练先在仿真模型中进行强化学习,行走速度快于改造的四足运动模型。

9月17日周四
  1. IsaacLab releases78

    Isaac Lab 3.0 早期访问版发布,支持多后端与无 Kit 运行

    Isaac Lab 3.0 Early Access 发布,引入工厂式多后端架构,物理、渲染与可视化可分别选择 isaacsim_physx、ovphysx、newton_mjwarp 等配置,并支持不安装 Isaac Sim 的无 Kit 工作流。

    推荐理由:Isaac Lab 3.0 早期访问版把物理、渲染与可视化拆成可切换后端,并给出 2.x 到 3.0 的迁移清单,便于评估现有训练流程的改动量。

9月13日周日
  1. genesis releases30

    Genesis v1.4.1 发布:大幅提升大规模场景 CPU/GPU 性能

    Genesis 发布 v1.4.1,重点提升大规模场景下 CPU 与 GPU 的性能,速度随岛屿数量呈亚线性下降,不平衡场景的 Jacobi 均衡开销大幅降低,接触密集场景在 CPU 上明显加速。新版本支持不含 joint2 的 MJCF 关节等式,并修复 glTF 归一化整数访问器解码、法线与纹理坐标保留、MJCF 关节执行器力范围等问题。

9月12日周六
9月11日周五
  1. qbitai38

    高德扫街榜2026全面AI化,空间智能引擎ABot-Earth 0.7亮相

    高德9月10日宣布扫街榜全面AI化,升级后的2026版用AI算法理解不同导航到店行为的评分权重。其空间智能核心引擎ABot-Earth 0.7被称为全球首个3D原生城市世界模型,仅需一张卫星图或一段文字,在消费级GPU上跑10分钟即可生成真实街景3D城市,效率比传统方法提升1000倍,已覆盖190多个国家、300多座城市。

  2. NVIDIA blog robotics71

    Skild AI 发布 S1 机器人基础模型,单段视频即可学习新任务

    Skild AI 发布 S1 机器人基础模型,可用单段视频演示作为提示,在不更新权重、不做任务专项后训练的情况下执行此前未见的长程任务,最长约 10 分钟,涵盖装盆、做煎饼、手冲咖啡和套件装配等。

    推荐理由:S1 用单段视频提示完成长程任务且不更新权重,读者可据此判断免重训部署路径的可行边界。

9月10日周四
  1. HF blog60

    SyncWorld:视觉校准让世界模型成为零样本模拟器

    Hugging Face 论文页介绍 SyncWorld,一种通过视觉校准让世界模型在未见相机、环境和本体上做上下文机器人世界建模的方法,无需下游训练。该方法以少量视觉交互作为上下文,尝试模拟机器人控制带来的视觉后果。

    推荐理由:SyncWorld 提出用视觉校准让世界模型在未见相机与环境上做零样本仿真,读者可了解其免下游训练的思路。

9月9日周三
  1. mujoco releases38

    MuJoCo 3.13.0 发布:新增 discrete 积分器与 Python 3.15 支持

    MuJoCo 3.13.0 发布,新增 discrete 积分器,将约束求解与隐式速度更新合并为一步,使被动弹簧和执行器位置增益在远超显式稳定极限的时间步下保持稳定。该版本还新增 Python 3.15(GIL 与自由线程)支持、站点几何关联网格、传感器 cutoff 属性,并移除 implicit/implicitfast 下 flex 有效度量的特例,相关模型需改用 discrete 积分器。

9月7日周一
  1. genesis releases36

    Genesis v1.4.0 发布:支持场景与轨迹导出为独立归档并位精确回放

    Genesis 发布 v1.4.0,支持将场景连同完整轨迹导出为独立归档,可在任意机器上通过 gs replay 实现位精确回放,目前仅支持刚体求解器。该版本还新增在内存中保存与恢复已构建场景、在连杆任意局部点施加外部力旋量,并修复了大量与资产解析相关的缺陷。

9月5日周六
9月3日周四
  1. IEEE Spectrum robotics22

    德州农工大学 RoboBall:用巨型充气机器人球探索月球陨石坑

    德州农工大学团队研发的 1.8 米宽、150 公斤充气机器人 RoboBall III,通过内部摆锤移动重心滚动前进,仅用两个执行器,可翻越障碍并爬上 20 度斜坡。该机器人设想由月球车运至陨石坑边缘后自主下探,并用小型火箭将地质样本射回坑外,相关设计与德州采石场测试结果已发表于 IEEE Transactions on Field Robotics。

9月2日周三
  1. qbitai78

    李飞飞 World Labs 发布多模态世界模型 Atlas

    李飞飞 World Labs 发布多模态世界模型 Atlas,称其可仅凭一张图片生成像素级相机控制的图像和视频,最高输出 1 分钟、1440p 视频,并基于一张到数十张输入图像重建真实场景、输出显式 3D 表示。

    推荐理由:Atlas 把相机控制生成、3D 重建与 Real-to-Sim 串成一条路径,可据此判断世界模型在机器人训练数据上的落点。