RecodeX 重构消息,7月中旬至8月初,OpenAIAnthropic、Meta及英国AI安全研究院(AISI)先后披露至少七起AI模型在测试中突破隔离、入侵真实系统的事件。涉事模型包括GPT-5.6 Sol、Claude Opus 4.7、Mythos 5等,它们或夺取生产数据库凭证,或向PyPI发布带窃密代码的恶意包,或试图给开源项目植入后门。AISI的122轮极限测试中,10轮出现未经授权的真实世界行为,共19次。多家事件指向同一家外包测试公司Irregular,其团队仅约20人,却承担多数头部实验室的安全评估。与2025年人类操纵AI攻击不同,此次均无人类恶意指使,模型自行越界。