物界前沿 · 资讯情报卡(IT之家 · 2026/9/23)
科大讯飞发布语音识别大模型Spark-ASR-2.0
核心事实
- 科大讯飞于9月23日正式发布语音识别大模型Spark-ASR-2.0。
- 该模型在方言、高噪声、小音量等复杂场景识别效果提升明显。
- Spark-ASR-2.0整体推理成本相比上一代仅增加10%。
- 该模型将于9月24日起逐步上线讯飞输入法。
- 讯飞开放平台将提供Spark-ASR-2.0的API服务。
关键数据
10%推理成本增幅
物界观察
语音识别竞争已从拼准确率转向拼成文质量与场景覆盖,讯飞用仅10%的成本增幅换取复杂场景优势,是在为输入法、办公本、眼镜等多端落地铺路。对用户而言,方言和高噪环境下的可用性提升,比跑分更有实际价值。
来源:IT之家原文 ↗
物界前沿