主要来源IT之家
查看原文事件专题 · 多源确认
火山引擎发布豆包音频生成模型1.0,支持多模态参考与长时一致性
火山引擎发布豆包音频生成模型1.0(Doubao-Seed-Audio 1.0),首次支持将文本、音频等多模态输入端到端生成目标音频。该模型能在长时生成中保持多角色音色一致性,减少后期修音工作。单条Prompt可编排角色对白、情绪语气、背景音乐等,直接产出完整音频作品。火山方舟已开启API邀测,个人用户可体验30分钟创作额度。
当前结论
火山引擎新模型能一次编排对白、音效、配乐,还能保持10分钟的角色音色一致,省掉后期对轨修音,音频创作者值得一试。
6 个信源71° AI 热度最后更新 2026/6/24 01:39:42
证据链
相关来源 1orange.ai
查看原文相关来源 2pandaily
查看原文相关来源 3歸藏(guizang.ai)
查看原文相关来源 4向阳乔木
查看原文相关来源 5shao__meng
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。