RecodeX 重构消息,OpenAI表示,已对Astra所有智能代理应用中的风险行为与目标偏差实施全域监控。Astra是一款尚未发布的模型,并未参与攻击Hugging Face。鉴于目前无法排除Astra具备关键网络攻击能力,OpenAI已暂停相关内部活动,并将为高性能模型实行更严格的安全管控,包括隔离测试环境。公司还将向第三方测试合作方提供建议性安全管控措施,并与政府机构及精选人工智能安全机构合作对Astra开展能力测试。