事件追踪 · 持续发展中

ROK-FORTRESS安全基准

持续追踪ROK-FORTRESS安全基准相关报道与进展。

我的关注 →RSS 订阅
关注仅保存在当前浏览器和域名中,无需登录,不会自动跨设备同步。

事件时间线

按最新发布排序

持续追踪ROK-FORTRESS安全基准相关报道与进展。

Unite中性

Scale AI与韩国AI安全研究所发布英韩双语对抗安全基准ROK-FORTRESS

RecodeX 重构消息,Scale AI于2026年9月17日发布ROK-FORTRESS的测试结果。该基准由Scale AI与韩国人工智能安全研究所联合开发,是一套英韩双语对抗性安全基准。结果显示,在评估的近14个前沿模型中,几乎所有模型对以韩语撰写、并植根于韩国语境的提示词,测得的危害程度都更低。该基准采用“创译矩阵”设计,而非将固定提示词直接翻译成另一种语言。