SpaceXAI 发布 Grok Voice Transcribe 2.0 语音转文本模型,错误率降低约一半
SpaceXAI 新出的 Grok Voice Transcribe 2.0 语音转文本模型,错误率比之前低了一半,价格还和以前一样,挺划算的。
IT之家原文
SpaceXAI 新出的 Grok Voice Transcribe 2.0 语音转文本模型,错误率比之前低了一半,价格还和以前一样,挺划算的。
朋友,OpenAI和Anthropic都发布了新模型,GPT-6和Claude Fable 5.1,还有Google等公司的语音转文本模型,错误率都低于4%,这些新模型和技能变化信息很实用。
Google本周发布了Gemini 3.5 Transcribe语音模型和Omni 1.1 Flash,新增视频编辑和Gmail管理功能。
Google新发布的Gemini 3.5 Transcribe支持85种语言,错误率低至2.6%,还提供两种端点选择,适合语音助手和转录管道使用。
实时语音助手开发者终于有了速度最快的 STT 模型——每秒处理 303 秒音频,成本还低,做语音交互的团队可以直接在 Together AI 上试试。