RecodeX 重构消息,Scale AI于2026年9月17日发布ROK-FORTRESS的测试结果。该基准由Scale AI与韩国人工智能安全研究所联合开发,是一套英韩双语对抗性安全基准。结果显示,在评估的近14个前沿模型中,几乎所有模型对以韩语撰写、并植根于韩国语境的提示词,测得的危害程度都更低。该基准采用“创译矩阵”设计,而非将固定提示词直接翻译成另一种语言。