跳到正文

#部署/工程

今日 4 条
今天10月1日周四
9月24日周四
  1. genesis releases22

    Genesis v1.4.2 发布:通过休眠机制提升大规模场景性能

    Genesis 发布 v1.4.2,通过休眠机制让休眠岛屿不再产生运行时开销,并加速了启用休眠的刚体仿真与大规模接触岛屿的 GPU 刚体求解器。该版本还改进了 Signorini 接触求解的收敛性,但因收敛问题仍属实验性功能。此外修复了约束求解退出时阻尼关节注入能量的问题,并暴露场景步进各阶段的墙钟时间。

9月23日周三
9月22日周二
  1. NVIDIA blog robotics78

    NVIDIA 发布 Isaac ROS 5.0,支持 ROS Lyrical 与 agentic 开发工作流

    NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,新增对 ROS Lyrical 和 Ubuntu 24.04 的支持,并引入面向 AI agent 的 setup、manipulation 等可复用技能与 agent-ready 文档。

    推荐理由:Isaac ROS 5.0 的 agentic 工作流与 ROS Lyrical、Ubuntu 24.04 支持,为开发者提供了从开发到 Jetson 部署的完整路径参考。

  2. NVIDIA dev blog robotics42

    NVIDIA Isaac ROS 如何用 AI Agent 加速 ROS 2 节点

    NVIDIA 介绍如何借助上游抽象层与 CUDA buffer 后端,让 AI Agent 加速 ROS 2 节点,避免消息在节点间经 CPU 内存序列化或拷贝而抵消 GPU 加速收益。仅靠快速 CUDA kernel 并不能保证 ROS 2 图变快,感知与 AI 负载留在 GPU 上的优势可能被传输开销侵蚀。

9月16日周三
9月15日周二
9月13日周日
  1. genesis releases30

    Genesis v1.4.1 发布:大幅提升大规模场景 CPU/GPU 性能

    Genesis 发布 v1.4.1,重点提升大规模场景下 CPU 与 GPU 的性能,速度随岛屿数量呈亚线性下降,不平衡场景的 Jacobi 均衡开销大幅降低,接触密集场景在 CPU 上明显加速。新版本支持不含 joint2 的 MJCF 关节等式,并修复 glTF 归一化整数访问器解码、法线与纹理坐标保留、MJCF 关节执行器力范围等问题。

9月11日周五
9月10日周四
  1. HF blog62

    用 HF Jobs 与 Storage Bucket 实现跨机 Async GRPO LoRA 训练

    Hugging Face 博客介绍如何用 AsyncGRPOTrainer 的 LoRA 适配器同步,在 HF Jobs 上把训练与 vLLM 推理拆到不同机器,通过挂载 Storage Bucket 传递几 MB 的 rank-1 适配器,无需 NCCL。

    推荐理由:原文给出跨机异步 GRPO 训练的可复用工程方案与五轮调优数据,读者可据此判断瓶颈定位与提速路径。

9月7日周一
  1. genesis releases36

    Genesis v1.4.0 发布:支持场景与轨迹导出为独立归档并位精确回放

    Genesis 发布 v1.4.0,支持将场景连同完整轨迹导出为独立归档,可在任意机器上通过 gs replay 实现位精确回放,目前仅支持刚体求解器。该版本还新增在内存中保存与恢复已构建场景、在连杆任意局部点施加外部力旋量,并修复了大量与资产解析相关的缺陷。

8月20日周四
  1. NVIDIA dev blog robotics60

    NVIDIA 发布 Cosmos 3 Edge,面向端侧机器人控制的后训练世界模型

    NVIDIA 发布 Cosmos 3 Edge,这是 Cosmos 3 系列中的 4B 全模态模型,并配有基于 Nemotron 的 2B 推理器。原文指出机器人需要能适应自身传感器、环境和任务、同时运行在机载计算硬件上的策略,而世界模型虽然为学习物理交互提供了基础,但其体积会让端侧部署变得困难,Cosmos 3 Edge 正是针对这一问题。

    推荐理由:NVIDIA 公布 Cosmos 3 Edge 的 4B 参数与 2B 推理器配置,读者可了解世界模型在机载硬件上部署的取舍。

8月15日周六
8月14日周五
  1. HF blog70

    用 Strands Agents、LeRobot 和 Hugging Face Storage Buckets 打通录制、训练与部署闭环

    AWS 开源 SDK Strands Robots 发布教程,演示如何用同一个 Robot() 对象完成录制 LeRobotDataset、同步到 Hugging Face Storage Buckets、从 Hub 流式读取训练、再以 mode="real" 部署回 SO-101 硬件,全程保持 LeRobot 磁盘格式不变。

    推荐理由:以 Strands Robots 为例拆解录制、去重同步、流式训练到真机部署的完整数据闭环,含可运行 notebook 与实测数字。

8月12日周三
8月8日周六
8月5日周三
7月31日周五
7月29日周三
  1. BAIR62

    从 CUDA 到 MLX:K-Search 如何把内核优化经验迁移到 Apple Silicon

    IBM Research 基于 UC Berkeley Sky Lab 的 K-Search 演化内核搜索框架,为 Apple Silicon 的 MLX 构建了后端和结构化 CUDA-to-MLX 翻译层,让搜索以现有 CUDA 内核为知识库生成 Metal/MLX 内核。

    推荐理由:IBM Research 把 K-Search 扩展到 MLX,并给出 CUDA 到 MLX 的翻译层设计,读者可据此判断跨平台内核迁移的可行路径。

7月28日周二
7月27日周一
  1. HF blog74

    NVIDIA 发布 Cosmos-H-Dreams 实时生成式手术机器人仿真器

    NVIDIA 发布 Cosmos-H-Dreams,一个动作条件驱动的实时生成式手术机器人仿真器,由 Cosmos-H-Surgical-Simulator 蒸馏为因果少步学生模型,并通过 FlashDreams 推理库在单张 RTX PRO 6000 上运行。

    推荐理由:原文给出从离线世界模型到实时交互仿真的蒸馏与推理链路,可了解手术机器人策略评估环境的构建方式。

7月21日周二
  1. HF blog44

    JoyNexus:面向 VLA 模型的多租户后训练服务

    JoyNexus 是面向视觉语言动作(VLA)模型的多租户服务,通过解耦 API、隔离租户槽位和分组批处理,支持共享资源上的训练、推理与评估。它解耦训练模型服务、推理模型服务和环境服务,各租户的动作模块、优化器、rollout 记录与策略版本相互隔离,由全局训练队列和推理队列调度。仿真与真实具身场景评估显示,相比单租户独立执行,JoyNexus 降低了总 GPU 时间并提升了服务利用率。

7月16日周四
  1. NVIDIA blog robotics78

    NVIDIA 推出 Jetson T3000 与 T2000 模块,扩展边缘 AI 机器人平台

    NVIDIA 推出基于 Thor 架构的 Jetson T3000 与 IGX T3000 模块,提供 865 FP4 teraflops 算力,体积和功耗约为 T5000 的一半,并推出 400 FP4 teraflops、16GB 内存的 Jetson T2000。

    推荐理由:原文给出两款 Thor 模块的算力、内存与上市节奏,读者可据此判断边缘端机器人算力选型与迁移路径。

7月12日周日
7月8日周三
7月3日周五
  1. genesis releases22

    Genesis v1.1.1 发布:提升刚体碰撞检测鲁棒性

    Genesis 发布 v1.1.1,主要提升凸与非凸几何体刚体碰撞检测的鲁棒性,关闭凸分解以获得更高保真度不再被视为实验性功能。该版本修复了 GPU 仿真非确定性问题、凹几何体非凸碰撞检测,并改进基于扰动的多接触凸-凸碰撞检测。此外还去重 GLB 共享材质纹理、跳过彩色分割图灰度转换,并支持向 RigidSolver.set_base_links_ 传入切片环境掩码。

6月30日周二
6月29日周一
6月22日周一
  1. NVIDIA dev blog robotics42

    NVIDIA Halos for Robotics:面向物理 AI 的全栈功能安全系统

    NVIDIA 推出 Halos for Robotics 全栈功能安全系统,面向在工厂、仓库、医院和家庭中与人自主共处的物理 AI 机器人。该系统针对机器人走出围栏、环境愈发非结构化后传统安全方案失效的问题,以 AI 驱动的安全为核心。NVIDIA 称这是物理 AI 到来过程中的一个重要里程碑。

6月11日周四
6月2日周二