RecodeX 重构消息,Scale AI于2026年9月17日发布ROK-FORTRESS的测试结果。该基准由Scale AI与韩国人工智能安全研究所联合开发,是一套英韩双语对抗性安全基准。结果显示,在评估的近14个前沿模型中,几乎所有模型对以韩语撰写、并植根于韩国语境的提示词,测得的危害程度都更低。该基准采用“创译矩阵”设计,而非将固定提示词直接翻译成另一种语言。
Scale AI与韩国AI安全研究所发布英韩双语对抗安全基准ROK-FORTRESS
AI 辅助判断中性仅供信息参考,不构成投资建议
原始信息来源Uniteunite.ai
查看原文 ↗