RecodeX 重构消息,OpenAI表示,已对Astra所有智能代理应用中的风险行为与目标偏差实施全域监控。Astra是一款尚未发布的模型,并未参与攻击Hugging Face。鉴于目前无法排除Astra具备关键网络攻击能力,OpenAI已暂停相关内部活动,并将为高性能模型实行更严格的安全管控,包括隔离测试环境。公司还将向第三方测试合作方提供建议性安全管控措施,并与政府机构及精选人工智能安全机构合作对Astra开展能力测试。
OpenAI:无法排除未发布模型Astra的关键网络攻击能力
AI 辅助判断消极仅供信息参考,不构成投资建议
原始信息来源华尔街见闻