RecodeX 重构消息,OpenAI当地时间8月7日发布安全公告,内部评估显示其下一代模型“Astra”在智能编程和网络安全能力方面取得显著进展,目前无法排除该模型达到“关键级”网络安全能力水平的可能性。相关评估结果已触发《准备框架》中的安全响应措施。OpenAI称,关键级网络安全能力指模型能在无需人工干预的情况下,针对多个强化防护的真实关键系统发现并开发零日漏洞,或仅根据高层攻击目标制定新型端到端网络攻击策略。Astra尚未用于此前涉及HuggingFace的安全事件。公司已加强安全措施,包括隔离测试环境、限制网络与工具访问、强化模型权重保护与加密、增加监控检测等。