豆包 App 上线了视频通话,能边看视频边提问,认人、读图表都行,延迟低,比 GPT Live 更自然,不用内测直接玩。
豆包 App 的视频通话功能已全量上线,基于 SeedRealtime 原生音视频全双工大模型。实测中,豆包能识别 YouTube 视频中的人物并正确回答身份,还能解读一闪而过的图表内容。对话延迟低,语音自然,没有 GPT Live 的“老外腔”。用户更新到最新版后,点击“打电话”图标并开启摄像头即可使用。
昨天豆包的视频通话功能升级了,感觉比 GPT Live 还强! 可以看我录屏,真的超预期。 测试让豆包陪我一起看一个Youtube视频,画面出现个人,直接问这人是谁,竟然答对了! 画面有个一闪而过...
昨天豆包的视频通话功能升级了,感觉比 GPT Live 还强! 可以看我录屏,真的超预期。 测试让豆包陪我一起看一个Youtube视频,画面出现个人,直接问这人是谁,竟然答对了! 画面有个一闪而过的图表,问:“刚才有个图表,你能给我解读下吗?”。 它竟然知道我指的是哪个图,并完整解释。 对话延迟低,语音自然,也没有GPT Live的老外腔(国产模型天然优势),很像真人对话。 未来场景相当多啊!K12教育、导览、机器人、实时翻译总结等。 Seed官方公众号说这个技术叫:原生音视频全双工大模型 SeedRealtime。 豆包 App 已全量上线,更新到最新版,点"打电话"图标,开摄像头就能用,不用申请内测。 下面技术解读和另一个测试。 Your browser does not support the video tag. 🔗 View on Twitter 💬 4 🔄 0 ❤️ 1 👀 1941 📊 5 ⚡