48kHz 近期进展 48kHz视频与立体声实时生成技术突破 标题: 世界模型实现24FPS视频与48kHz立体声实时生成,将完全开源 来源: 量子位 URL: https://www.qbitai.com/2026/08/474334.html 近期,一项技术突破使得24FPS视频与48kHz立体声的实时生成成为可能,这一技术将完全开源,为音视频领域带来新的发展机遇。 阿里千问发布语音合成大模型Qwen-Audio-3.0-TTS 标题: 阿里千问发布语音合成大模型Qwen-Audio-3.0-TTS,登顶Artificial Analysis 来源: IT之家 URL: https://www.ithome.com/0/979/128.htm 阿里千问推出的语音合成大模型Qwen-Audio-3.0-TTS在Artificial Analysis评测中取得了优异成绩,展示了语音合成技术的最新进展。 SGLang-Omni集成MOSS-TTS-Local Transformer v1.5开源语音克隆模型 标题: SGLang-Omni 集成 MOSS-TTS-Local Transformer v1.5 开源语音克隆模型 来源: LMSYS Org (SGLang) URL: https://x.com/lmsysorg/status/2067483636010815834 SGLang-Omni集成了一款名为MOSS-TTS-Local Transformer v1.5的开源语音克隆模型,这一模型的发布将进一步推动语音技术的开源与共享。 当前焦点与观察点 48kHz技术的发展正在不断突破,从视频与音频的实时生成到语音合成大模型的推出,都显示出该技术在多个领域的广泛应用潜力。未来,随着技术的不断成熟和普及,48kHz有望成为音视频和语音领域的新标准。