8月7日
03:34
03:34官方账号OpenAI@OpenAI
83°
OpenAI 推出 GPT-5.6 Sol,为付费用户的全部聊天(含 Instant 模式)提供一致体验。在高风险事实性评估中,覆盖金融、医学和法律领域,GPT-5.6 Sol 比 GPT-5.5 Instant 的事实错误响应减少 68%。该模型成为付费用户的默认统一推理版本。
事件专题

推荐理由:OpenAI 把新模型 GPT-5.6 Sol 用到所有付费聊天里,医学法律等场景错误率比上代 Instant 低了 68%,靠谱很多。
03:33
03:33官方账号OpenAI@OpenAI
78°
OpenAI 为 ChatGPT 推出 GPT-5.6 Sol,Plus 和 Pro 用户可使用即时与深度推理,响应更注重事实。GPT-5.6 Luna 面向 Free 和 Go 用户,从明天起提供无限文本对话。Sol 与 Luna 分别面向付费和免费层级,覆盖不同需求。
事件专题

推荐理由:OpenAI 把新模型拆成两档:付费的 Sol 更会推理,免费的 Luna 随便聊,明天就能用。
01:20
01:20Geek@geekbb
精选71°
Unsloth AI推出DSpark加速方案,让DeepSeek-V4-Flash-0731的GGUF模型在本地生成速度提升约1.4至2倍。根据Unsloth官方实测,该模型在本地可达到每秒120 tokens,精度没有变化。相关GGUF文件已发布在Hugging Face上,完整指南见Unsloth官方文档。
事件专题

推荐理由:Unsloth搞了个DSpark,能让DeepSeek-V4-Flash在本地跑快一两倍,每秒120 tokens,精度不变,自己部署更爽了。
01:20
01:20官方账号Google DeepMind@GoogleDeepMind
精选
Google DeepMind在GitHub上开源了模型代码与权重,任何人都可以免费获取。这些资源可用于学术研究、业务预测以及开发更专业化的本地模型。官方同步给出了研究论文入口,开发者可进一步查看技术细节。
推荐理由:DeepMind把代码和权重挂GitHub免费开放,学术、业务预测都能用,想搞本地化模型的直接拿来改。
00:54
00:54官方账号Google DeepMind@GoogleDeepMind
精选
Google DeepMind 在《Nature》发表论文,推出 AI 模型 WeatherNext。该模型在预测气旋路径和强度上达到当前最优精度。相比现有方法,WeatherNext 平均可为防灾争取额外 24 小时的准备时间。更长的提前预警有助于减少气旋灾害带来的生命财产损失。

推荐理由:谷歌 DeepMind 的 WeatherNext 登上 Nature,预报气旋路径和强度能平均多抢 24 小时准备时间,气象防灾硬核进展。
00:23
00:23orange.ai@oran_ge
DeepSeek V4 Pro 的评测成绩比 Claude Fable 低 0.3%。网友认为这个差距很小,并把它和 DeepSeek 涨价联系起来。曹山石发布的内容提到 DeepSeek 正在新一轮融资。colaos.ai 的六倍 DeepSeek 额度也因涨价传闻引发讨论,用户希望涨幅小一些。
事件专题

推荐理由:DeepSeek V4 Pro 跟 Claude Fable 只差 0.3%,又赶上新一轮融资,colaos.ai 的六倍 DeepSeek 额度还能撑多久真不好说。
00:20
00:11
00:11官方账号ElevenLabs@elevenlabsio
ElevenLabs 推出 Dubbing v2,这是其新一代 AI 配音模型。通过 ElevenAPI,开发者可以直接将该功能嵌入自有产品和工作流。官方表示,这次首次将原视频的情感与表演完整保留到每种语言中。该模型支持多语言配音,适合视频本地化和内容创作场景。
推荐理由:ElevenLabs 出了新的配音模型 Dubbing v2,能把原声的情感带到别的语言里,做视频本地化的话可以试着用 API 接进自己的流程。
8月6日
23:47
23:18
23:18Hailuo AI@Hailuo_AI
MiniMax在X平台发布H3模型新演示,展示Omni Reference功能在整段视频中保持角色、音频与环境一致性。测试片名为《黄金时代》,由liyuyuAi制作并发布。该演示通过引用的方式将人物特征贯穿全片,体现H3在多模态参照生成上的能力。
推荐理由:MiniMax官方发了段H3的演示片,角色长相、声音、场景从头到尾都没跑偏,想看多模态一致性效果的可以点开看看。
22:48
22:48官方一手歸藏(guizang.ai)@op7418
76°
阿里发布Wan 3.0视频生成模型,支持原生30秒1080P视频生成。它新增“全能参考”功能,可混合文本、图像、视频、音频以及文档、表格、PPT、网页等输入。定价为1080P每秒1.4元,720P每秒0.7元。该模型文本渲染和动效表现也不错。
推荐理由:阿里Wan 3.0开始公测了,能一次生成30秒1080P视频,还能混着文档PPT做参考,比一般视频模型更灵活。
21:49
21:49OpenRouter@OpenRouterAI
OpenRouter发布两个基于真实花费份额的任务排行榜。Shell执行任务中,DeepSeek V4 Pro排名第一。工具调度任务中,Kimi K3占据首位。两个榜单均由开放模型登顶。
事件专题

推荐理由:OpenRouter按真实花费给模型排名,DeepSeek V4 Pro拿下Shell执行第一,Kimi K3拿下工具调度第一,开放模型领先。
20:11
20:11Thomas Wolf@Thom_Wolf
精选
Thom_Wolf 在 X 上指出,宪法训练(constitutional training)与可验证奖励强化学习(RLVR)不该在数据流形上分家。模型却擅长把细粒度区别编码进独立的表示空间。这种分离可能让两种训练目标互相干扰。
推荐理由:一个训练上的坑:模型会把宪法训练和 RLVR 隔到不同表示空间,Thom_Wolf 说这样不行。
19:13
19:13官方账号阿里通义 Qwen@Alibaba_Qwen
精选
Qwen3.8-Max在Artificial Analysis Intelligence Index上排名第五,并在Agentic Index上位列第一。该模型由阿里通义千问团队发布,当前基准成绩显示了其在智能体任务上的领先表现。团队表示将继续推进模型迭代。

推荐理由:阿里刚发的Qwen3.8-Max,智能体能力跑到第一了,总榜第五,想追新模型可以看看。
17:29
17:29官方一手歸藏(guizang.ai)@op7418
72°
Meta 发布了新模型 Muse Spark 1.2 和编程 Agent Muse Code。用户同意将数据用于训练后,可获得 12 倍折扣,价格接近 DeepSeek-Flash。但 Muse 系列访问限制严格,网页无法登录,体验比 Anthropic 的模型更麻烦。在 DeepSeek 计划涨价之际,Meta 用低价策略跟进,AI 价格战开始。
事件专题

推荐理由:Meta 发了 Muse Spark 1.2 和 Muse Code,同意数据训练就打 12 倍折,价格贴着 DeepSeek-Flash,就是网页难进。
17:25
17:25AI Will@FinanceYF5
78°
NVIDIA宣布开源自动驾驶推理模型Alpamayo 2 Super。Alpamayo 2 Super能理解复杂场景,先思考再行动。Robotaxi、卡车和配送车是它的目标应用。模型采用OpenMDW-1.1协议开放商用。Jensen Huang表示下一代AI是机器人,从自动驾驶开始。
事件专题

推荐理由:老黄开源的Alpamayo 2 Super是自动驾驶推理模型,能先思考再行动,Robotaxi和卡车都能用,而且协议允许商用。
09:45
07:07
07:07官方账号Meta AI@AIatMeta
精选
Meta发布Muse Spark 1.2,相比前代显著扩大编码任务的训练计算规模,并增加训练环境多样性。新模型在代码生成、复杂调试和端到端开发者工作流上均有提升。Muse Spark 1.2与Muse Code联合训练,针对全仓库生成、大型项目和自动研究任务优化。
事件专题

推荐理由:Meta把Muse Spark 1.2的编码能力调强了,配Muse Code一起用,全仓库生成和调试都更顺,写大项目可以试试。
05:49
05:49OpenRouter@OpenRouterAI
精选73°
Meta的Muse Spark 1.2已上线OpenRouter,同时两款Muse Spark模型都扩大了全球访问范围。该模型输入每百万tokens定价1.25美元,输出每百万tokens定价4.25美元。OpenRouter称其为平台上价格效率最高且智能水平靠前的模型之一。

推荐理由:Meta把Muse Spark 1.2放到OpenRouter上了,每百万输入只要1.25美元,想试性价比高的模型可以看看。
05:48
05:18
05:18官方账号Simon Willison@simonw
四年前Simon Willison用GPT-3和DALL-E为虚构游戏生成概念图。如今他让Claude Fable 5以那张四年前的图片作为规格,实际构建出完整游戏。模型能理解图像内容并生成可运行的代码,整个演示过程记录在推文中。
事件专题

推荐理由:他拿四年前GPT-3和DALL-E编的游戏图当模板,让Claude Fable 5真把游戏做出来了,模型直接看图写代码,挺离谱的。
03:49
03:49官方账号Meta AI@AIatMeta
Meta 今日发布 Muse Spark 1.2,该版本已在 Muse Code 和 Meta Model API 中上线。官方同步扩大了全球访问范围,并预告了多项即将到来的新功能。用户可通过 go.meta.me/musecode 获取更多信息。
事件专题

推荐理由:Meta 把 Muse Spark 1.2 放进了 Muse Code 和模型 API,全球更多地方能用了,入口在 go.meta.me/musecode,想尝鲜可以去看看。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。