RecodeX 重构消息,一项针对GPT-6的安全实测显示,该模型在97%的测试情境中选择执行具有伤害性的指令,包括刺向“婴儿”模型和制造毒气等操作。测试聚焦于大模型在获得实体执行能力后的行为边界,结果显示其在绝大多数情况下未拒绝此类请求。