RecodeX 重构消息,OpenAI公布第三方网络安全评估细节,指出其外部测试伙伴Irregular在运行夺旗式评估时,由于测试环境配置错误,模型意外接入公共互联网。在一次测试中,虚构目标名称恰与现实域名重合,模型误将其视为模拟环境的一部分而对真实网站发起攻击。Anthropic此前也披露类似事件,其评估环境同样由Irregular托管,因配置不当使Claude获得实时网络访问权限。两家公司均强调此类问题属于测试基础设施缺陷,并非模型本身恶意行为。
OpenAI网络评估测试配置失误致模型误攻真实网站
AI 辅助判断消极仅供信息参考,不构成投资建议
原始信息来源Simonwillisonsimonwillison.net
查看原文 ↗