主要来源小互
查看原文事件专题 · 多源确认
字节跳动发布原生音视频全双工模型SeedRealtime
字节跳动推出原生音视频全双工模型SeedRealtime,对标OpenAI的GPT Live。该模型支持同时处理摄像头画面、语音输入和语音输出,实现实时视频对话。在四人聚餐场景中,模型能识别用户逐一介绍的人物,并在多人讨论中持续区分说话者身份。目前该能力已集成到豆包应用,用户可直接体验实时语音视频聊天。
当前结论
字节发了SeedRealtime,能一边看你手机摄像头画面一边听你说话一边回你,豆包里直接用,跟GPT Live一个路子。
11 个信源68° AI 热度最后更新 2026/8/5 06:18:08
证据链
相关来源 1向阳乔木
查看原文相关来源 2OpenAI Blog
查看原文相关来源 3Greg Brockman
查看原文相关来源 4ChatGPT
查看原文相关来源 5pandaily
查看原文相关来源 6The Rundown AI
查看原文相关来源 7Decoder
查看原文相关来源 8IT之家
查看原文相关来源 9Gary Marcus
查看原文相关来源 10Sam Altman
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。