AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

多说话者分离

共 1 条相关 AI 资讯
9月2日
08:29
08:29IT之家(博客/媒体)
精选73°
Meta推出首个实时音频感知模型Muse Voice Transcribe,支持20余人分轨转写。该模型通过Meta Model API调用,定价为每1000分钟音频3美元。模型整合流式自动语音识别、说话人分离与端点检测,支持70余种语言,其中25种已完成验证。截至2026年9月1日,该模型位列Artificial Analysis流式语音转文本排行榜第1名。
AI产品Muse Voice TranscribeMeta实时音频转写
事件专题

推荐理由:Meta发布实时音频转写模型,20人分轨只需3美元/千分钟,还能自适应调整延迟。
原文
精选全部日报登录