首页 > 资讯 > 科大讯飞发布最新一代语音识别大模型Spark-ASR-2.0

科大讯飞发布最新一代语音识别大模型Spark-ASR-2.0

36氪快讯 2026-09-23 18:01 3 阅读 查看原文

9月23日,科大讯飞正式发布最新一代语音识别大模型Spark-ASR-2.0。

据了解,该模型延续并深化了Spark-Audio-1.0-Preview语音基座大模型的技术能力,通过非自回归与LLM增强自回归协同、中英文混合文本与声学联合增强、动态上下文注入等关键技术,实现了整体语音识别效果的大幅提升。

同时,Spark-ASR-2.0的推理成本相对前一代模型仅增加了10%。

Spark-ASR-2.0将从9月24日开始逐步上线讯飞输入法,并且通过讯飞开放平台提供API服务,后续将陆续应用在讯飞AI眼镜、讯飞智能办公本、讯飞听见等产品上。