NEWS / 摘要

科大讯飞发布全新语音识别大模型 Spark-ASR-2.0,明日上线讯飞输入法

来源摘要

IT之家 9 月 23 日消息,今日,科大讯飞正式发布最新一代语音识别大模型 Spark-ASR-2.0。据官方介绍,Spark-ASR-2.0 通过非自回归与 LLM 增强自回归协同、中英文混合文本与声学联合增强、动态上下文注入等关键技术创新,整体的语音识别效果大幅提升,尤其在通用识别(中英文混合、方言、专业术语)、复杂声学场景识别(高噪、小音量、快语速、儿童)、上下文识别和文本流畅规范性等方面改善明显。在效果提升的同时,Spark-ASR-2.0 的整体推理成本相对 Spark-ASR-1.0 仅增加了 10%。官方称,“如果说过去的语音识别追求的是…

摘要由机器生成(来自来源站点),可能存在偏差; 本站不转载全文,请以原文为准。