RecodeX 重构消息,Mistral发布了新的3B参数开源模型Shieldstral,用于检测AI输入和输出的安全违规行为。与使用固定类别不同,该模型通过自然语言的“是/否”问题来判断安全风险。在某些基准测试中,其表现与体积大7倍的模型相当。运营商可在运行时自定义判断标准,无需依赖第三方分类体系,且模型支持本地运行。