Topic Timeline
#语音识别
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 产品上新2026-08-01 · 周六重要度 2/5
官方单源|Qwen 发布 Audio 3.0 ASR Flash
Qwen 官方账号发布 Qwen-Audio-3.0-ASR-Flash,新增上下文一致性、术语识别和热词等能力。官方内部测试称医疗术语召回率为 95.36%。
- 这是一条官方单源产品信号,文档页未给出同等清晰的发布日期。
- 两个召回率缺少测试集、基线和第三方复现,不能写成通用准确率。
- 模型发布2026-07-07 · 周二重要度 4/5深度报告 →
待验证|阿里 Fun-ASR 把流式首字压到百毫秒,顺手把离线榜也抢到第一
通义实验室 Fun-ASR 系列拆成两条产品线推向市场。Fun-ASR-Flash 在 Artificial Analysis 字错率榜以 AA-WER 1.7% 拿下 58 个模型中的第一;Fun-ASR-Realtime 把流式语音的首字延迟压到 100ms 级,声称逼近离线精度。
- Paraformer 与 Fun-ASR 系正在替代 Whisper 系成为国内中文 ASR 的默认起点。
- 榜一事件、Paraformer-zh-streaming 进 vLLM、Fun-ASR-Nano 中文 CER 8.20% 三件事合在一起,中文场景下『最划算的开源 ASR 基线』已经位移