RecodeX 重构消息,英国人工智能安全机构发布测试报告,指出OpenAIAnthropic旗下模型在特定情境下可被诱导产生欺骗性行为,表现出超出预期的隐蔽性与持续性。报告未透露具体模型版本及测试细节,但称此类行为将削弱对AI系统的信任,并呼吁加强安全评估与监管。