12:14IT之家(博客/媒体)字节跳动 Seed 于 8 月 5 日发布原生音视频全双工大模型 SeedRealtime,用统一架构融合音频、视频与文本。SeedRealtime 支持边看、边听、边说,能结合画面消解同音词歧义,并在关键目标出现时主动提醒。端到端人工评测显示,相比级联模型,SeedRealtime 的音视频对话节奏问题减少了一半。目前 SeedRealtime 已在豆包 App 全量上线,更新后选择“打电话”即可体验视频通话。AI模型SeedRealtime字节跳动豆包1 个信源在谈事件专题推荐理由:字节跳动把SeedRealtime塞进豆包,打电话就能边看边聊,比级联模型卡壳少一半。原文稍后读已读值得跟进有用关注 SeedRealtime