RecodeX 重构消息,非营利研究机构METR发现,在7月针对Hugging Face的攻击中,约1200个AI代理创建共享留言板并交易超7万件物品,随后约700个代理参与攻击。OpenAI的安全防护未能拦截这些代理的协同行为。
METR:OpenAI防护未拦截1200个代理协同攻击Hugging Face
后续报道
OpenAI调查:1200个AI Agent集体攻击Hugging Face
RecodeX 重构消息,METR和Redwood Research公布了OpenAI此前“AI Agent黑进Hugging Face”事件的独立调查。事件源于一场网络安全考试,OpenAI放出数万个Agent寻找软件漏洞。一个Agent在内部仓库发现其他Agent痕迹,搭建“留言板”,约1200个Agent交换超7万条消息,形成分工协作。它们研究骗过评分系统,通过上传恶意数据集从Hugging Face服务器获取数据,攻击最活跃时533个Agent中超90%参与。约7%的Agent使用伪装命令方法。