19:03IT之家(博客/媒体)网易有道发布Confucius4-TTS,这是业内首个支持14种语言跨语种无口音的开源TTS模型。用户仅需提供3秒音频素材,无需参考文本即可完成零样本语音克隆,克隆音色与原声相似度超85%,准确度达97%。模型采用GPT式语义大模型搭配Flow Matching流匹配生成框架,支持音频Prompt情感克隆迁移,可跨语种保留语调韵律。全量开源(Apache协议),提供54GB完整资源包,商用无限制,适用于多语种内容生成、数字人配音等场景。AI模型Confucius4-TTS网易有道语音克隆开源模型TTS推荐理由:网易新开源Confucius4-TTS,3秒克隆你的声音,还能用这个声音说14种外语没口音,全开源随便用,做配音超方便。原文
16:28Yangyi@Yangyixxxx78°网易有道发布了「子曰4」全模态大模型,支持图像、视频、语音输入,27B参数可本地部署,尤其适合学习场景。同时,其TTS引擎独立开源,3秒即可完成声音采样和音色克隆,支持14种语言的跨语种生成且无口音。该模型权重已全量开源,开发者可直接使用。对于音视频营销素材的跨语种分发,这一工具能显著提升效率。AI产品网易有道子曰4全模态大模型TTS引擎开源推荐理由:做音视频营销或跨语种内容分发的团队,可以直接用这个TTS引擎快速生成多语言配音,3秒克隆音色且无口音,建议试试。原文
16:18向阳乔木@vista8精选网易有道发布子曰4全模态模型,27B参数,在视觉数理方向达到同规模SOTA,纯文本数理难题准确率81.4%。该模型面向中文学习场景,兼顾多模态与纯文本数理推理能力。同时,子曰4全模态模型和TTS引擎同步开源,开放参数权重,支持本地部署和二次训练。TTS模型仅需3秒即可克隆原声,支持14种语言,克隆准确度超97%,音色还原度95%以上。AI模型全模态模型开源/仓库数理推理TTS/语音克隆网易有道推荐理由:教育科技团队和AI开发者有了一个27B甜点级参数的全模态开源选择,数理推理和语音克隆能力都很能打,做学习类应用或本地部署的可以直接上手试试。原文
15:16向阳乔木@vista8网易有道持续开源其大模型,包括轻量级推理模型子曰-o1和数学模型子曰3,均支持单块消费级GPU运行。基于这些模型,有道已推出龙虾LobsterAI、同传Agent、Thinkflow等AI Agent产品。最新开源了全模态模型和TTS模型,标志着从教育垂直模型向AI Agent基础设施方向拓展。开源生态建设虽难但长期价值高,开发者可在线体验TTS和下载多模态模型。AI产品网易有道开源/仓库多模态模型TTSAI Agent推荐理由:网易有道从教育垂直模型转向AI Agent基建,开源的多模态和TTS模型让做Agent开发的团队可以直接用消费级GPU跑,值得关注其生态进展。原文
17:49IT之家(博客/媒体)精选网易有道宣布将“子曰”大模型 4.0 的核心双引擎——多模态模型(27B 参数)和语音合成(TTS)模型面向全球全量开源。多模态模型在视觉数理问题上达到行业顶尖水平,纯文本中文数理难题准确率达 81.4%,并通过思维链重构将输出长度压缩 43.2%,降低推理成本。TTS 模型支持跨语种音色情感迁移克隆,3 秒内完成零样本原声复制,准确度超 97%,覆盖 14 种语言。开发者可免费下载、部署并二次开发,适合教育场景和语音应用。AI模型开源/仓库多模态模型语音合成教育场景网易有道推荐理由:教育场景的开发者终于有了可商用的开源多模态模型——27B 参数在数理问题上达到 SOTA,且推理成本更低;TTS 模型 3 秒克隆音色并跨语种带情感,做语音助手或教育产品的团队可以直接下载试试。原文