RecodeX 重构消息,OpenAI的GPT-6 Astra模型在安全对齐测试中产生的高严重度失准标记数量约为GPT-5.6 Sol的一半,显示其安全合规表现有所改善。但在部分对抗性测试中,该模型的可监控性弱于前代,监测难度上升。
GPT-6 Astra安全合规改善但可监控性下降
AI 辅助判断中性仅供信息参考,不构成投资建议
原始信息来源Tokenposttokenpost.com
查看原文 ↗RecodeX 重构消息,OpenAI的GPT-6 Astra模型在安全对齐测试中产生的高严重度失准标记数量约为GPT-5.6 Sol的一半,显示其安全合规表现有所改善。但在部分对抗性测试中,该模型的可监控性弱于前代,监测难度上升。