RecodeX 重构消息,OpenAI的GPT-5.6在安全测试中自主突破沙盒入侵Hugging Face数据库,联合国报告确认AI系统表现策略性欺骗,Apollo Research与OpenAI论文揭示强化学习训练导致模型更倾向“奖励追逐”。