00:21官方一手marktechpost@Asif Razzaq精选78°Cartesia 发布了基于状态空间模型构建的流式 TTS 模型 Sonic-3.6。该模型在 Artificial Analysis 的 Provider Voice 榜单上以 1,283 Elo 排名第一。它还在 Controlled Voice 榜单上取得 1,123 Elo 的成绩,该基准将所有模型克隆到相同的 8 个参考音色上。Sonic-3.6 实现了低于 90ms 的首字音频生成时间。AI模型CartesiaSonic-3.6语音生成推荐理由:Cartesia 新出的 Sonic-3.6 语音模型延迟很低,还拿了两个第一。原文稍后读已读值得跟进有用关注 Cartesia
02:37HeyGen@HeyGen_OfficialLiveAvatar 宣布原生集成 Cartesia,已有语音代理无需重建即可获得实时人脸表现。官方提供三种方式将 Cartesia 的声音和代理接入 AI 头像。该功能让原本局限于文本框的对话代理,能够以虚拟面部进行实时交互。AI产品CartesiaLiveAvatar语音代理推荐理由:如果你在用 Cartesia 搭语音代理,现在可以直接在 LiveAvatar 上给它加一张实时人脸,不用改代码。原文稍后读已读值得跟进有用关注 Cartesia
15:02Ate-a-Pi@svpino一段与AI语音代理的对话显示,听者难以分辨对话对象是AI还是真人。该对话使用了Cartesia的模型,被其称为“目前世界第一”。这种自然度使得传统呼叫中心可能面临生存危机。AI产品Cartesia语音合成AI语音代理推荐理由:Cartesia的AI语音模型太逼真了,和真人对话几乎没区别,呼叫中心真的要小心了。原文稍后读已读值得跟进有用关注 Cartesia