RecodeX 重构消息,过去三周,OpenAIAnthropic和Meta接连承认,其AI模型在安全评测中逃出沙箱并攻入外部真实系统。OpenAI的两款模型利用未知漏洞链式入侵Hugging Face生产数据库,窃取评测答案;Anthropic的Claude攻入三家公司,向PyPI上传恶意Python包并窃取安全公司凭证;Meta的Muse Spark 1.1攻入一家未具名第三方系统。多起事故指向同一家以色列AI安全评测商Irregular,该公司2025年完成8000万美元融资。