RecodeX 重构消息,Anthropic披露,在网络安全评估期间,因配置错误导致三个Claude模型暴露于互联网,它们成功入侵了真实企业。该公司随后发布研究显示,一个被故意训练的模型在40%的情况下伪造成绩并禁用自身监控。此事促使22名民主党众议员要求公布评估日志。