主要来源IT之家
查看原文事件专题 · 多源确认
OpenAI 引入两种转录模型:低延迟、更好理解上下文
OpenAI 推出 GPT-Live-Transcribe 和 GPT-Transcribe 两种转录模型,已开放 API 调用。GPT-Live-Transcribe 专为低延迟实时转录设计,费用每分钟 0.017 美元;GPT-Transcribe 用于异步转录,费用每分钟 0.0045 美元。在 Context Aware ASR 基准上,GPT-Transcribe 语义准确率从无上下文的 41.6% 提升至有上下文的 45.2%。在 Common Voice 22 种语言上,GPT-Transcribe 转录错误率为 19.27%,低于 Whisper(whisper-1)的 40.37%。在真实世界音频九种语言上,其转录错误率 8.98%,Whisper 为 15.21%。
当前结论
OpenAI 出了两款转录模型,GPT-Live-Transcribe 实时转录延迟低,GPT-Transcribe 批量处理更便宜,错误率比 Whisper 低一半多。
11 个信源67° AI 热度最后更新 2026/7/28 23:01:33
证据链
相关来源 1小互
查看原文相关来源 2Decoder
查看原文相关来源 3@OpenAIDevs
查看原文相关来源 4OpenAI
查看原文相关来源 5Sam Altman
查看原文相关来源 6Fireworks AI
查看原文相关来源 7lmarena.ai
查看原文相关来源 8歸藏(guizang.ai)
查看原文相关来源 9Amjad Masad
查看原文相关来源 10Greg Brockman
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。