主要来源IT之家
查看原文事件专题 · 单一信源
Meta发布实时音频感知模型Muse Voice Transcribe
Meta推出首个实时音频感知模型Muse Voice Transcribe,支持20余人分轨转写。该模型通过Meta Model API调用,定价为每1000分钟音频3美元。模型整合流式自动语音识别、说话人分离与端点检测,支持70余种语言,其中25种已完成验证。截至2026年9月1日,该模型位列Artificial Analysis流式语音转文本排行榜第1名。
当前结论
Meta发布实时音频转写模型,20人分轨只需3美元/千分钟,还能自适应调整延迟。
2 个信源73° AI 热度最后更新 2026/9/2 00:23:26
证据链
相关来源 1Meta AI
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。