Hugging Face 上线 StartLux-Decision-4B 决策模型,含 0.8B 至 35B-A3B 六个规格
StartLux-Decision-4B 在 Hugging Face 发布,可对状态回答选择题、是/否题和评分题,每个选项返回概率,请求响应沿用 TypeSafe /v1/systemone 格式。
StartLux-Decision-4B 在 Hugging Face 发布,可对状态回答选择题、是/否题和评分题,每个选项返回概率,请求响应沿用 TypeSafe /v1/systemone 格式。
Hugging Face 发布 StartLux-Decision 系列决策模型,覆盖 0.8B 至 35B-A3B 六种规模,对状态类问题输出各选项概率,沿用 TypeSafe /v1/systemone 格式。
Hugging Face 上线数据集 leapshared/SciEdu_3exp_374epi,由 LeRobot 生成,采用 v3.0 格式,含 374 条 episode、440776 帧、16 个任务,机器人类型为 bi_openarm_follower。
Hugging Face 上线数据集 Jianguo-Huang11/APM-Bench。该数据集页面未提供更多说明,仅附有 Hugging Face 推进开源与开放科学、推动人工智能民主化的使命表述。
NVIDIA 在 CES 上展示 Caterpillar 座舱 AI 助手,基于 Jetson Thor 本地运行 Nemotron 语音模型与 Qwen3 4B,无需云端连接。
NVIDIA 在 CES 展示 Caterpillar 座舱内 Cat AI Assistant 原型,基于 Jetson Thor 本地运行 Nemotron 语音模型与 vLLM 服务的 Qwen3 4B,无需云端连接。
Genesis 发布 v1.4.3,重点提升 GPU 上非批处理至中等批量(约 4000)的仿真速度并全面降低显存占用,Windows 上编译速度最高提升至 3 倍。该版本还修复了 glTF 解析、MJCF 材质纹理保留、Apple Metal 性能模式编译失败、IMU 读数记录与相机外参更新等多项问题,并升级至 Quadrants 1.3.3。
rasyosef/Qwen3-1.7B-DSpark 已在 Hugging Face 发布。该页面未提供模型参数、训练数据或评测结果等具体信息,仅附有 Hugging Face 推进开源与开放科学的通用说明。
Hugging Face Hub 上线 toniotgz/act_pick_box,这是一个用 LeRobot 0.6.2 训练的 ACT 模仿学习策略,在 so_follower 机器人上执行“从桌上拿起盒子”任务。
Hugging Face 上线了 maria715 的 CAT_llama3b_likeZephyr_eps0150_42_relativelr_utility_500_NEW_weight000371875 模型页面。该页面未提供模型参数、训练数据或评测结果等具体信息,仅保留 Hugging Face 推进开源与开放科学的平台说明。
Hugging Face 上出现了一个名为 maria715/CAT_adv_eps02_42_relativelr_REFAIT 的模型仓库。该页面未提供模型架构、训练数据、任务类型或性能指标等具体信息,仅包含 Hugging Face 推进开源与开放科学的使命声明。
Hugging Face 上线 TheBobTheBlob/so101_pickplace_v1 数据集,由 LeRobot 生成,面向 so101_follower 机器人,含 30 条 episode、12029 帧、1 个任务、60 段视频,30 fps,动作与状态均为 6 维关节位置。
Hugging Face 用户 TheBobTheBlob 发布 act_so101_pickplace_v1,这是一个用 LeRobot 训练并上传至 Hub 的 ACT(Action Chunking with Transformers)模仿学习策略,从遥操作数据中学习预测短动作块。
bartowski 基于 llama.cpp b11259 为 OmniJev 的 OneJev-9B 模型发布 GGUF 量化版本,覆盖 bf16 到 IQ2_M 共 22 个文件,默认推荐 Q4_K_M(5.84GB)。该模型支持文本与图像输入,仓库同时提供 mmproj 多模态投影文件,可搭配任意量化版本使用。
Hugging Face Hub 上出现了一个由 transformers 推送的模型卡,模型 ID 为 Nat1an/cerulean-lab4-f-e570cde2。该模型卡为自动生成,开发者、模型类型、语言、许可证、微调来源、训练数据与评估结果等信息均标注为待补充。
Hugging Face 上线了名为 Nat1an/cerulean-lab4-h-6a29c74a 的模型页面。该页面目前仅展示 Hugging Face 推进开源与开放科学、推动人工智能民主化的使命表述,未提供模型架构、参数规模、训练数据或评测结果等具体信息。
Hugging Face Hub 上出现了一个由 Nat1an 分享的 transformers 模型,模型 ID 为 cerulean-lab4-e-d8d5d8e9。该模型卡为自动生成,开发方、模型类型、语言、许可证、训练数据与评测结果等信息均标注为待补充。
Hugging Face 上线 strands-isaaclab-h1-rough 数据集,记录宇树 19 自由度 H1 人形机器人在 NVIDIA Isaac Lab 程序化崎岖地形上按指令基座速度行走,共 12 条 episode、6000 帧、50 fps。
fanqi-robo 在 Hugging Face 发布 π0.5 微调检查点 pi05_insert_gear_in_gripper_b0,基于 lerobot/pi05_base 在 50 集双臂 YAM 插齿轮数据集上全量微调,训练 20k 步、全局 batch 32、lr 2.5e-5,采用 QUANTILES 归一化与绝对关节、3 路相机、无图像增强。
Hugging Face 上出现 ribeiroyuri/CampoVivo-Qwen3-4B-Instruct-v3 模型页面。该页面未提供模型能力、训练数据或评测结果等具体信息,仅附有 Hugging Face 推进开源与开放科学的使命说明。
基于 lerobot/smolvla_base 微调的 SmolVLA 策略 mongster7/smolvla_dice_50k 在 LeKiwi 移动机械臂上完成"把红色骰子放进篮子"任务。
Hugging Face 上出现由 LeRobot 生成的 UR5e 螺母装配数据集,含 100 条 episode、24602 帧、1 个任务,机器人类型为 ur5e。数据以 20 fps 采集,动作维度 7、状态维度 9,配两路 84×84 视频,采用绝对动作与 OSC_POS 控制,训练集划分 0:100。
Hugging Face 用户 castanetnicolas 发布基于 ACT 模仿学习方法的 UR5e 抓取放置策略,使用 LeRobot 0.6.1 训练并推送至 Hub。
Hugging Face 上发布了一个基于 ACT(Action Chunking with Transformers)的 UR5e 抓取放置策略,用 LeRobot 0.6.1 训练并推送至 Hub。
Hugging Face 上发布 ResidentEvian/hf_act_recordpolicy0,这是一个用 LeRobot 0.6.2 训练的 ACT(Action Chunking with Transformers)模仿学习策略,机器人类型为 so_follower,输入 6 维状态与 480×640 前视图像,输出 6 维动作。
Hugging Face 上线 nakanakagawa/sponge_task_9_30_v2 数据集,由 LeRobot 生成,机器人类型为 so_follower,共 6 条 episode、2395 帧、1 个任务,帧率 20 fps,采用 codebase_version v3.0。
Hugging Face 上出现名为 emmanuel-v/policy_2026-09-30_shake_it_up_on_cart_100kHz_nfft4096 的模型条目,名称包含 100kHz 与 nfft4096 等参数标识。该条目页面未提供更多模型细节,仅附有 Hugging Face 推进人工智能开源与开放科学的使命说明。
Hugging Face 数据集 PiotrSty/slayer-ocr-experiment-evidence 无法加载,原因是 train 与 validation 两个 split 使用了不同的数据文件格式,触发 FileFormatMismatchBetweenSplitsError。
Hugging Face 数据集 PiotrSty/slayer-ocr-datasets 因各 split 使用不同数据文件格式而无法加载,train、validation、test 分别对应 text、imagefolder、json 格式,触发 FileFormatMismatchBetweenSplitsError。
Hugging Face 论文页介绍 ReImaGin,它把图像生成模型作为多模态 LLM 的灵活视觉推理机制,可接受自然语言指令执行去除遮挡、由多视角生成平面图等开放式视觉操作。在包含多视角空间推理与碰撞预测的六项视觉推理任务上,ReImaGin 持续优于纯文本推理和专用视觉工具基线,提升最高达 25%。
Hugging Face 上线数据集 ujheo/pen6_20260930_173022,由 LeRobot 生成,采用 v3.0 数据格式,机器人类型为 so_follower。该数据集含 5 个 episode、3191 帧、1 个任务,以 30 fps 记录 6 自由度动作与状态,并配 front、top 两路 480×640 AV1 视频。
ECHO-G 发布,可从语音和文本生成宇树 G1 的全身动作,所有模型输出 39 通道机器人运动,帧率 30 FPS。代码版本 v0.2.0,提供音频加文本、纯音频、纯文本及 HumanRetarget 多组权重,新输入支持最长 20 秒或 600 帧、256 个文本 token,更长输入需先分段。
推荐理由:ECHO-G 开源了从语音和文本生成宇树 G1 全身动作的模型权重与推理流程,读者可据此了解输入规格与复现入口。
论文提出 AnyStep-WAM 框架,通过预算对齐的教师轨迹蒸馏训练区间条件流映射,支持从单步预测到多步细化的动作生成,并用轻量风险收益调度器按单步预览选择最小去噪预算。
推荐理由:论文给出可调去噪步数的世界动作模型框架,读者可了解按任务难度分配推理预算的具体做法与实测数据。
Hugging Face 上线数据集 Sarthak213/doosra-cricket。该页面未提供数据集内容、规模或用途等具体说明,仅标注其属于 Hugging Face Datasets 平台。
Hugging Face 发布 Sys1Cal-v1 基准数据集,用于直接评估结构化概率输出而非仅检查预测类别的置信度。在 Jev 上测试发现,Noul 和 Score 的概率接近真实值,而二元 Choice 输出存在系统性非线性失真,可通过引入潜在第三分量 Uncertain 建模。数据集与评估代码已公开,支持在其他结构化决策模型上复现。
Hugging Face Hub 上线 karrlleereal/omx_act_policy5,这是一个用 LeRobot 训练并推送的 ACT(Action Chunking with Transformers)模仿学习策略,从遥操作数据中学习、预测短动作块而非单步动作。
Hugging Face 上发布 ssdunit/act_abc_sim_lego_sorting_100k,这是一个用 LeRobot 0.6.1 训练的 ACT 模仿学习策略,任务为 lego_blocks_sorting。
Hugging Face 上公开的论文 EpiCon 提出一种共享多模态记忆框架,让不同智能体在不更新宿主模型参数的情况下复用彼此经验。它由两个独立训练的 2B 模型组成:记忆控制器与树状自组织器,分别负责跨尝试精炼文本引导与视觉证据、分层整合经验并检索规则。
Hugging Face 上出现一个用 LeRobot 训练并推送至 Hub 的 ACT(Action Chunking with Transformers)模仿学习策略,它从遥操作数据学习,预测短动作块而非单步动作。该策略采用 apache-2.0 许可,可用 lerobot-train 从零训练,并用 lerobot-record 配合 so100_follower 机器人本体运行推理与评估。
EVO-WAM 提出一种让世界动作模型(WAM)在无需额外专家示范、也不在外部环境执行候选动作的情况下适配新任务的框架,通过状态预测与锚定多帧上下文实现完整自回归 rollout,并用视觉语言模型筛选完成任务的前缀、用逆动力学模型验证视频与动作一致性,再迭代训练。
推荐理由:论文给出无需额外专家示范、靠自生成视频动作轨迹适配新任务的框架,并附仿真与真机成功率数据。