跳到正文
原文
HF blog·· 2 天前AI 评分43

Hugging Face 上发布 strands-isaaclab-ant-131k-policy:13.1 万并行环境的 Isaac Lab Ant PPO 策略

cagataydev/strands-isaaclab-ant-131k-policy · Hugging Face

AI 导读

Hugging Face 上发布 strands-isaaclab-ant-131k-policy,这是用 rsl_rl PPO 在 Isaac Lab 的 Isaac-Ant 任务上训练的机器人策略,训练规模达 131,072 个并行环境。

来源:HF blog · huggingface.co