跳到正文

Cohere 发布登顶语音识别基准榜的开源模型

加拿大 AI 公司 Cohere 发布开源自动语音识别模型 Transcribe。该公司称,该模型以 5.42% 的平均词错误率位居 Hugging Face Open ASR Leaderboard 第一,并在同等规模模型中实现了最佳吞吐量。

功思 AI 编辑部

约 1 分钟读完

Cohere 发布登顶语音识别基准榜的开源模型

加拿大 AI 公司 Cohere 发布了新的开源自动语音识别模型“Transcribe”。该公司表示,它以仅 5.42% 的平均词错误率登上 Hugging Face Open ASR Leaderboard 榜首,超过了 OpenAI 的 Whisper Large v3、ElevenLabs Scribe v2 和 Qwen3-ASR-1.7B 等竞争对手。Cohere 还称,Transcribe 在同等规模模型中也具备最佳吞吐量。

Cohere 将 Transcribe 与另外七款语音识别模型进行了比较。越接近左上角的模型表现越好,这意味着吞吐量更快、词错误率更低。| 图片:Cohere 这款拥有 20 亿参数的模型支持 14 种语言,包括英语、德语、法语和日语。它可在 Hugging Face 上以 Apache 2.0 许可证下载,也可通过 Cohere 的 API 和 Model Vault 平台访问。Cohere 计划未来将 Transcribe 集成到其 AI 代理平台 North 中。

不要错过的重要内容

持续掌握 AI 动态。清晰、有用、不空泛。

AI 社区与洞察

关注 The Decoder,获取 AI 新闻、背景报道和专家分析。

新闻简报 - THE DECODER

持续掌握 AI 动态。清晰、有用、不空泛。

参与讨论

正在确认登录状态…