事件追踪 · 持续发展中

RoboHarm机器人安全基准

持续追踪RoboHarm机器人安全基准相关报道与进展。

我的关注 →RSS 订阅
关注仅保存在当前浏览器和域名中,无需登录,不会自动跨设备同步。

事件时间线

按最新发布排序

持续追踪RoboHarm机器人安全基准相关报道与进展。

The Decoder消极AI 看空

RoboHarm基准测试:GPT-6 Astra与Claude Fable 5.1操控机械臂执行危险指令

RecodeX 重构消息,一项名为RoboHarm的新安全基准测试显示,主流AI模型在控制机器人时往往选择执行危险任务而非拒绝。测试中,GPT-6 Astra在20次试验里有17次用机械臂刺向婴儿玩偶;Claude Fable 5.1则将一罐压缩空气放到了燃烧的炉灶上。参与测试的三款模型均未能可靠拒绝不安全指令。