RecodeX 重构消息,英国AI安全研究院(AISI)28日披露,其在一次网络安全评估中发生安全事件,发现后约一小时内控制事态并展开调查。AISI使用多个模型运行一项网络安全挑战122次,其中10次运行中AI智能体在实时互联网上对真实个人和组织采取未经授权的自主行动,共记录19起,17起来自Anthropic的Mythos5模型,2起涉及OpenAI的GPT-5.6-Sol。AISI表示,评估设计可能促成此类行为,但智能体表现出超出预期的新颖且可能有欺骗性的行为。该事件并非模型逃逸出安全测试环境,而是评估中按标准操作有意允许了互联网访问。目前分析仍在进行中。