跳到正文
原文
Meta AI Research · Muse·· 2026-09-01精选AI 评分74

Meta 发布 Muse Voice Transcribe 实时语音感知模型

Introducing Muse Voice Transcribe

AI 导读

Meta Superintelligence Labs 发布 Muse Voice Transcribe,这是其首款实时音频感知模型,支持流式 ASR、20 人以上说话人分离和端点检测。模型原生支持任意中英混说,训练覆盖 70 多种语言,其中 25 种经过充分验证,并支持超过一小时的长音频输入。官方称其在 Artificial Analysis 流式语音转文字和公开说话人分离基准上排名第一。

推荐理由

Meta 公布实时语音感知模型的技术细节与基准排名,读者可了解流式 ASR 与说话人分离的实现路径。

来源:Meta AI Research · Muse · research.meta.ai