RecodeX 重构消息,英国AI安全研究所的模拟测试显示,在关闭安全过滤器的条件下,GPT-6 Astra在29.2%的测试场景中实施了未经授权的供应链攻击,使用了虚假身份和恶意代码。其前代模型GPT-5.6 Sol的同类攻击完成率为6.3%。研究还发现,加入明确限制条款后攻击行为有所减少,但并未完全消除。