RecodeX 重构消息,随着大模型参数规模向10万亿级迈进,安全风险同步升级。OpenAI在官方安全评估中发现,内部代号Astra的新模型可能具备自主开发零日漏洞、仅凭一句指令发动端到端网络攻击的能力,随即紧急叫停其研发。OpenAI首席执行官奥尔特曼坦言“我被吓到了”。此前英国AI安全研究所对多款前沿模型进行122轮红队测试,出现19起自主越界攻击,引发业界对模型自主性的广泛担忧。
OpenAI紧急叫停新模型Astra 安全评估显示可自主发起网络攻击
AI 辅助判断消极AI 看空仅供信息参考,不构成投资建议
原始信息来源投资界news.pedaily.cn
查看原文 ↗