Speech

general · 首次出现 2026-05-22 · 最近出现 2026-09-11 · 累计提及 138

综述

  • 语音技术是近年来人工智能领域的一个重要分支,专注于语音识别、合成和交互等技术的研发和应用。
  • XX 近期进展

  • Adobe Firefly 扩充音频服务 原文标题:Adobe Firefly 近期发布了新的音频服务,这标志着其AI音频工具的进一步扩展。
  • Adobe Firefly 新增 AI 音频工具与 Google Gemini Omni Flash 原文标题:Adobe Firefly 的这次更新,使其音频处理能力得到了显著提升,同时也引入了与 Google Gemini Omni Flash 的合作。
  • 几何迭代检索方法用于神经音频编码器重合成 原文标题:该研究提出了一种新的神经音频编码器重合成方法,提高了音频生成的质量。
  • Pika发布4款声音模型,覆盖配音、语音、音乐、音效,价格低至同行1/20 原文标题:Pika Labs 推出了四款新的声音模型,旨在通过低廉的价格扩大其在声音合成领域的市场。
  • Pika发布四款音频模型,成本降低至市面最低 原文标题:Pika Labs 的这一举措旨在进一步降低音频处理成本,提高市场竞争力。
  • Pika 音频模型全线降价,Soundtrack 低至 0.617/秒 原文标题:Pika Labs 通过降低音频模型的价格,使得更多用户能够使用其产品。
  • VUI Labs语音模型Luna-TTS登顶TTS Arena,击败ElevenLabs 原文标题:VUI Labs 的 Luna-TTS 语音模型在 TTS Arena 的竞赛中击败了 ElevenLabs,显示了其技术的领先性。
  • SpaceXAI发布Grok Voice Think Fast 2.0语音模型,定价每分钟0.08美元 原文标题:SpaceXAI 的这一新产品定价非常具有竞争力,旨在为用户提供高质量的服务。
  • 用LangChain追踪Gemini Live语音代理的speech-to-speech循环 原文标题:LangChain 的应用进一步推动了语音技术的创新。
  • OpenAI releases new voice models for simultaneous speech and listening 原文标题:OpenAI 的新语音模型旨在提供更自然、更流畅的实时对话体验。
  • 当前焦点与观察点

    语音技术的快速发展带来了许多新的机会和挑战。价格战、技术领先和创新应用成为当前市场的焦点。随着技术的不断进步,语音交互的门槛正在降低,预计未来将会有更多创新产品和服务出现。

    相关报道

    10 条在档