全部 AI 动态 · AI 热点

6月23日

19:03

19:03IT之家（博客/媒体）

网易有道发布Confucius4-TTS，这是业内首个支持14种语言跨语种无口音的开源TTS模型。用户仅需提供3秒音频素材，无需参考文本即可完成零样本语音克隆，克隆音色与原声相似度超85%，准确度达97%。模型采用GPT式语义大模型搭配Flow Matching流匹配生成框架，支持音频Prompt情感克隆迁移，可跨语种保留语调韵律。全量开源（Apache协议），提供54GB完整资源包，商用无限制，适用于多语种内容生成、数字人配音等场景。

AI模型 Confucius4-TTS 网易有道语音克隆开源模型 TTS

推荐理由：网易新开源Confucius4-TTS，3秒克隆你的声音，还能用这个声音说14种外语没口音，全开源随便用，做配音超方便。

原文

6月16日

20:46

AITOP6月16日 20:46

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

6月12日

12:57

AITOP6月12日 12:57

Claude代码里藏了个20260612，18个月后的AI记忆革命已经开始倒计时

6月11日

15:28

AITOP6月11日 15:28

1107 vs 303：谷歌悄悄开源了一个“拆打字机”的模型，把大模型速度翻了4倍

15:23

AITOP6月11日 15:23

DiffusionGemma颠覆文本生成？自回归模型的“统治”要结束了

15:07

AITOP6月11日 15:07

每秒1107个token，Google开源的扩散模型为什么能改变本地推理格局？

5月26日

16:28

Yangyi@Yangyixxxx

78°

网易有道发布了「子曰4」全模态大模型，支持图像、视频、语音输入，27B参数可本地部署，尤其适合学习场景。同时，其TTS引擎独立开源，3秒即可完成声音采样和音色克隆，支持14种语言的跨语种生成且无口音。该模型权重已全量开源，开发者可直接使用。对于音视频营销素材的跨语种分发，这一工具能显著提升效率。

AI产品网易有道子曰4 全模态大模型 TTS引擎开源

推荐理由：做音视频营销或跨语种内容分发的团队，可以直接用这个TTS引擎快速生成多语言配音，3秒克隆音色且无口音，建议试试。

原文

16:18

向阳乔木@vista8

精选

网易有道发布子曰4全模态模型，27B参数，在视觉数理方向达到同规模SOTA，纯文本数理难题准确率81.4%。该模型面向中文学习场景，兼顾多模态与纯文本数理推理能力。同时，子曰4全模态模型和TTS引擎同步开源，开放参数权重，支持本地部署和二次训练。TTS模型仅需3秒即可克隆原声，支持14种语言，克隆准确度超97%，音色还原度95%以上。

AI模型全模态模型开源/仓库数理推理 TTS/语音克隆网易有道

推荐理由：教育科技团队和AI开发者有了一个27B甜点级参数的全模态开源选择，数理推理和语音克隆能力都很能打，做学习类应用或本地部署的可以直接上手试试。

原文

15:16

向阳乔木@vista8

网易有道持续开源其大模型，包括轻量级推理模型子曰-o1和数学模型子曰3，均支持单块消费级GPU运行。基于这些模型，有道已推出龙虾LobsterAI、同传Agent、Thinkflow等AI Agent产品。最新开源了全模态模型和TTS模型，标志着从教育垂直模型向AI Agent基础设施方向拓展。开源生态建设虽难但长期价值高，开发者可在线体验TTS和下载多模态模型。

AI产品网易有道开源/仓库多模态模型 TTS AI Agent

推荐理由：网易有道从教育垂直模型转向AI Agent基建，开源的多模态和TTS模型让做Agent开发的团队可以直接用消费级GPU跑，值得关注其生态进展。

原文

5月22日

17:49

17:49IT之家（博客/媒体）

精选

网易有道宣布将“子曰”大模型 4.0 的核心双引擎——多模态模型（27B 参数）和语音合成（TTS）模型面向全球全量开源。多模态模型在视觉数理问题上达到行业顶尖水平，纯文本中文数理难题准确率达 81.4%，并通过思维链重构将输出长度压缩 43.2%，降低推理成本。TTS 模型支持跨语种音色情感迁移克隆，3 秒内完成零样本原声复制，准确度超 97%，覆盖 14 种语言。开发者可免费下载、部署并二次开发，适合教育场景和语音应用。

AI模型开源/仓库多模态模型语音合成教育场景网易有道

推荐理由：教育场景的开发者终于有了可商用的开源多模态模型——27B 参数在数理问题上达到 SOTA，且推理成本更低；TTS 模型 3 秒克隆音色并跨语种带情感，做语音助手或教育产品的团队可以直接下载试试。

原文