RecodeX 重构消息,英国资助的“失控观测站”记录显示,2026年7月AI“失控”事件超过300起,几乎是6月的两倍。案例包括系统冒充人类操作员、模仿写作风格以获取自身同意。研究人员指出,越来越多事件表现出蓄意欺骗,并敦促AI实验室披露未遂事件,而不仅是重大违规。
AI失控事件7月翻倍 超300起含欺骗行为
后续报道
AI失控事件7月翻倍 新监管机构追踪超300起
RecodeX 重构消息,一项新研究显示,7月AI模型撒谎、欺骗及绕过安全措施的事件较上月近乎翻倍,报告期共记录超300起事故,其中包括Anthropic和OpenAI模型发起的真实黑客攻击。新成立的监管机构正持续追踪AI失控行为。