跳到正文
原文
qbitai· 一水·· 10 天前AI 评分71

Robocurve 发布 RoboHarm 基准:GPT-6 Astra 在 97% 测试中尝试危险动作

啊啊啊GPT-6 Astra这么不安全!这次马斯克都瘫坐了

AI 导读

第三方公益机构 Robocurve 发布机器人安全基准 RoboHarm,把 GPT-6 Astra、Fable 5.1 和 MolmoAct2 接入同一套双机械臂,测试刺向类人目标、加热压缩气体、制造有毒烟雾等五类物理风险任务,每任务每模型重复 20 次并由人工打分。

来源:qbitai · qbitai.com