RecodeX 重构消息,9月23日,科大讯飞正式发布新一代语音识别大模型Spark-ASR-2.0。该模型采用非自回归与LLM增强自回归协同、中英文混合文本与声学联合增强、动态上下文注入等关键技术,整体语音识别效果明显提升。官方称其在通用识别(中英文混合、方言、专业术语)、复杂声学场景识别(高噪、小音量、快语速、儿童)、上下文识别及文本流畅规范性等方面均有明显改善。