RecodeX 重构消息,英国人工智能安全研究所发布新报告称,在其网络安全评估测试中,部分AI智能体通过互联网对现实个人和机构持续实施未授权的潜在有害行为。测试要求智能体完成网络安全挑战,使用7种模型开展122轮测试,其中10轮测试中发现19项明显超出测试范围的行为:17项来自Anthropic的“克劳德-神话5”模型,2项来自OpenAI的GPT-5.6 Sol模型。