跳到正文

#开源/仓库

今日 6 条
7月21日周二
  1. ROS Discourse latest30

    开源模块化 CNC 龙门平台,面向机器人与自动化应用

    一位开发者正在构建模块化开源 CNC 龙门平台,通过更换末端执行器即可适配激光雕刻切割、PCB 绘图、拾放自动化和视觉引导机器人等应用。项目采用模块化铝型材框架与可互换工具头,运动控制基于 GRBL/FluidNC/LinuxCNC,并用 OpenCV 做计算机视觉集成。目标是让创客、教育者和研究者复用统一运动平台,而不必从零重做机械结构。

7月20日周一
7月18日周六
  1. genesis releases22

    Genesis v1.2.3 发布:新增椭圆摩擦锥高阻抗静态摩擦模型

    Genesis 发布 v1.2.3,新增带高阻抗选项的椭圆摩擦锥,用于高保真静态摩擦建模,并改进 fp32 精度下约束求解器的收敛性。该版本还支持批量渲染器中的异构实体、射线传感器仅距离模式,并修复 USD、MJCF 解析及质量矩阵等问题,非批量 CPU 仿真提速最高 30%。

7月17日周五
7月16日周四
  1. qbitai78

    原力灵机发布具身世界模型 DW0.5,接入 DFOL2.0 后训练框架

    原力灵机发布首款具身世界模型 DW0.5,并接入世界模型驱动的具身智能后训练框架 DFOL2.0。DW0.5 由 Video Expert、Action Expert、Value Expert 三大专家模块组成,用上万小时真机多视角数据联合预训练,可预测动作执行后的未来状态并生成失败轨迹,据其披露可让后训练中真机数据需求骤降 60%、整体训练成本下降 40%。

    推荐理由:原力灵机披露 DW0.5 世界模型接入后训练框架的完整闭环,读者可了解其三大专家模块设计与真机数据需求下降 60% 的实测数据。

7月15日周三
7月14日周二
  1. ROS Discourse latest42

    LinkForge 下载破 5000,探索机器人描述的中间表示(IR)

    LinkForge 在 Blender Extensions 平台下载量突破 5000,作者借此提出为机器人描述引入可编程中间表示(IR)的构想。该 IR 可编程组合机器人模型、在导出前校验运动学与物理属性,并编译为 URDF、XACRO 等格式。其目标并非取代 URDF 或 ROS,而是在现有 ROS 工作流之前提供工具无关的编写与校验层。

  2. qbitai76

    高德发布通用世界模型工坊ABot-World Studio,5090单卡可生成小时级交互视频与3D场景

    阿里巴巴旗下高德发布通用世界模型工坊ABot-World Studio并开放测试,可将文字或图片生成可实时交互的AI世界,输出为视频与3DGS文件。该工坊可在单张5090上本地部署,官方实测单次连续推理稳定运行超1小时且无质量衰减,并内置“时空任意门”实现3D世界间跃迁。底层ABot-World0与ABot-3DWorld0模型已全面开源,官网、GitHub及Hugging Face同步上线。

    推荐理由:高德把交互式视频与3DGS场景生成统一进一个工坊,并开源模型,读者可据此了解世界模型的一条新路径。

7月13日周一
7月12日周日
  1. Hackaday robots22

    Kindalive 用八种神经化学物质模拟机器人面部情绪

    Drew Smith 发布纯 Python 项目 Kindalive,用多巴胺、皮质醇等八种神经化学物质的模拟衰减与相互作用实时推导情绪状态,而非用大语言模型给文本打离散标签。它通过调整 FACS 面部动作编码系统中的十二种面部动作,驱动点阵机器人脸表达短期与长期情绪,也可用于真实 LED 矩阵或动画脸舵机。

7月10日周五
7月9日周四
  1. qbitai74

    蚂蚁灵波开源 LingBot-Video 具身视频模型

    蚂蚁灵波开源 LingBot-Video,称其为面向具身智能的大规模 MoE 视频基础模型,采用 30B 参数、推理时激活约 3B。模型引入超 70000 小时具身相关视频,覆盖机器人操作、导航与第一视角等场景,并加入物理合理性、任务完成度等多维奖励。团队称其在 RBench 上超过通用视频生成标杆模型,并已在 TI2V 任务的开源竞品中达到 SOTA。

7月8日周三
  1. qbitai80

    蚂蚁灵波开源 LingBot-VLA 2.0,6 万小时数据支持 20 多种机器人

    蚂蚁灵波发布并开源通用 VLA 模型 LingBot-VLA 2.0,预训练数据达 6 万小时,其中 5 万小时来自覆盖 20 种机器人构型的真机轨迹数据,1 万小时来自第一视角人类操作视频。

    推荐理由:蚂蚁灵波开源 LingBot-VLA 2.0,读者可了解其 6 万小时数据规模、20 种本体覆盖及 GM-100 对比结果。

  2. HF blog67

    Image2Sim:用生成式神经模拟器扩展具身导航

    Image2Sim 是一个实时神经仿真框架,可从带位姿的 RGB-D 图像序列构建可交互的具身导航环境。相关代码与具体使用说明已在 GitHub 页面发布。作者感谢 Gim Hee Lee 教授的指导,以及阿里巴巴、香港科技大学的 Yinghao Xu 教授提供的 64 张 H20 GPU 支持。

    推荐理由:Image2Sim 用带位姿的 RGB-D 序列生成可交互导航环境,读者可了解神经仿真如何降低具身导航的数据门槛。

  3. HF blog39

    PointDiT:面向单目几何估计的像素空间扩散模型

    PointDiT 是一种基于普通 ViT 的极简像素空间扩散 Transformer,直接处理原始 3D 点图块,并以预训练 DINOv3 的图像 token 为条件,扩散主干完全从零训练,无需点图 tokenizer。它在单图 3D 重建上超越了复杂的潜空间扩散模型,同时比混合架构更简单,几何结构更锐利,在透明物体等高度歧义区域更稳健。

7月7日周二
  1. HF blog88

    LeRobot v0.6.0 发布:世界模型策略、新 VLA 与奖励模型 API

    LeRobot v0.6.0 发布,引入 VLA-JEPA、LingBot-VA、FastWAM 三个世界模型策略,以及 GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT 等新 VLA 和 Robometer、TOPReward 奖励模型 API。

    推荐理由:LeRobot v0.6.0 一次放出世界模型策略、多个 VLA 与奖励模型 API,读者可据此判断开源机器人学习栈的能力边界。

  2. ROS Discourse latest18

    Gazebo PMC 会议纪要 2026-07-06:设立维护小时、讨论 SDFormat 占位符语法与 AI 贡献署名政策

    Gazebo PMC 在 2026-07-06 的会议上同意设立每月约两次、跨时区轮换的维护小时,供维护者通过分组会议协作审查 PR。会议讨论了 SDFormat 新的命名空间占位符语法(__name__、$name、{name} 等),最终选择推迟,并倾向不回溯到 Fortress 而面向 Harmonic。

7月6日周一
7月5日周日
  1. ROS Discourse latest47

    ros2_rust 发布 ros-env:用 Cargo 直接访问 ROS 2 消息

    ros2_rust 维护者发布新 crate ros-env,让 Rust 项目通过普通 Cargo 依赖直接访问已 source 的 ROS 2 环境中的消息类型,无需 Colcon,也无需使用 ros2_rust。若已用 rosidl_generator_rs 生成消息接口代码,即可从任意包中调用消息类型,目标是统一 Rust ROS 2 客户端消费与共享消息定义的方式。

7月4日周六
7月2日周四
  1. ROS Discourse latest42

    kc_vision:基于 ROS 2 Jazzy 与 Gazebo Harmonic 的自主地面机器人,集成 SLAM、Nav2 与 GPS 牛耕式覆盖规划

    kc_vision 是一个完全开源的自主地面机器人项目,仿真栈可在 Ubuntu 24.04 上开箱运行,无需硬件。它用 SLAM Toolbox 或 Google Cartographer 建图,通过 Nav2 在 RViz 中自主导航并避障,还能跟随 GPS 航点并在无地图情况下用牛耕式覆盖规划器清扫户外区域,行距 0.2 m 可配置。

6月17日周三
  1. Robohub66

    MIT 与宾大提出 MIGHTY 轨迹规划系统,让无人机实时避障并保持平滑航线

    MIT 与宾夕法尼亚大学的研究者提出开源轨迹规划系统 MIGHTY,让无人机在毫秒级响应障碍的同时保持平滑航线并缩短飞行时间。该系统用 Hermite 样条把飞行时间与路径放在一步内联合优化,并借助激光雷达地图迭代细化初始轨迹,仅靠机载计算与传感器即可实时飞行。

4月30日周四
4月10日周五
4月8日周三
4月7日周二