科大讯飞发布语音识别大模型Spark-ASR-2.0
RecodeX 重构消息,9月23日,科大讯飞正式发布新一代语音识别大模型Spark-ASR-2.0。该模型采用非自回归与LLM增强自回归协同、中英文混合文本与声学联合增强、动态上下文注入等关键技术,整体语音识别效果明显提升。官方称其在通用识别(中英文混合、方言、专业术语)、复杂声学场景识别(高噪、小音量、快语速、儿童)、上下文识别及文本流畅规范性等方面均有明显改善。
持续追踪科大讯飞Spark-ASR-2.0发布相关报道与进展。
关注仅保存在当前浏览器和域名中,无需登录,不会自动跨设备同步。RecodeX 重构消息,9月23日,科大讯飞正式发布新一代语音识别大模型Spark-ASR-2.0。该模型采用非自回归与LLM增强自回归协同、中英文混合文本与声学联合增强、动态上下文注入等关键技术,整体语音识别效果明显提升。官方称其在通用识别(中英文混合、方言、专业术语)、复杂声学场景识别(高噪、小音量、快语速、儿童)、上下文识别及文本流畅规范性等方面均有明显改善。