AB
AiBoss
News

Meta发布Muse Voice Transcribe实时语音转写模型

Meta发布Muse Voice Transcribe,可实时完成流式语音识别、20人以上说话人分离和端点检测,并支持25种以上语言及语码切换。

Meta发布Muse Voice Transcribe,并称其为Meta Superintelligence Labs开发的首个实时音频感知模型。模型可同时进行流式自动语音识别、20人以上说话人分离和端点检测,原生支持25种以上语言、句内语码切换,以及语言、关键词和上下文偏置。

Muse Voice Transcribe现已通过Meta Model API、Mac版Meta AI和Muse Code提供,Meta AI与Muse Code中的一键语音听写也已切换到该模型。官方页面未宣称开放模型权重,因此该产品不应写成开源发布。

参考:Meta AI Research发布页