8月14日
06:44
06:06
06:06Replicate@replicate
Minimax 旗下的 Hailuo AI 推出最新视频模型 H3,现已上线 Replicate 平台。H3 针对参考图生成和视频编辑场景做了专门调优,支持对话式交互和视频延长功能。用户可通过 Replicate 直接调用该模型进行创作和二次编辑。
推荐理由:海螺AI的H3模型上线Replicate了,支持参考图创作和视频编辑,还能加长视频,做视频的可以试试。
05:42
05:42Hailuo AI@Hailuo_AI
精选76°
MiniMax 正式发布新一代开源权重音乐模型 MiniMax-Music3。该模型定位生产级(production-ready),可用于多种音乐生成场景。官方称其为 SOTA 级开源音乐模型。权重开放,开发者可自行部署和微调。
推荐理由:MiniMax 把音乐模型开源了,叫 Music3,号称开源里最强,能直接生成各种风格的音乐,适合想做 AI 音乐应用的人。
05:19
05:19techcrunch@Russell Brandom
Writer 发布了基于 Z.ai 开源模型 GLM-5.2 的后训练新模型。新系统(基于 GLM-5.2)宣称以更低价格提供部署就绪能力,并升级 harness 控制 token 成本。Writer 表示,该模型延续了 GLM-5.2 的开源生态优势。
推荐理由:Writer 出了新模型,基于 GLM-5.2 改的,价格更低还升级工具省 token 成本,适合想省钱的开发者。
05:17
03:23
02:57
02:57官方账号Perplexity@perplexity_ai
Grok 4.6 已在 Perplexity 和 Perplexity Computer 上线。该模型在 WANDR 基准上位于性能和效率的帕累托前沿。相比 Fable 5,Grok 4.6 在结果持平的情况下成本降低超过 60%。用户现在即可在 Perplexity 生态中直接使用 Grok 4.6。
事件专题

推荐理由:Grok 4.6 上线 Perplexity 了,在 WANDR 上跟 Fable 5 结果持平,成本还低 60% 以上。
02:49
02:49官方账号Decoder@Matthias Bastian
71°
谷歌在 3.6 Flash 发布仅三周后推出 Gemini 3.7 Flash,定位为编码和 AI 智能体场景的旗舰工作模型。官方基准显示,Gemini 3.7 Flash 在编码任务上超过 Claude Sonnet 5 和 GPT-5.6 Terra,而价格仅为两者的一半。新模型的价格也比三周前的 Gemini 3.6 Flash 低 50%。

推荐理由:谷歌新出的 Gemini 3.7 Flash,编码和智能体能力更强,价格比 3.6 又砍半,还比 Claude 和 GPT 便宜一半,拿来写代码试试。
02:46
02:46lmarena.ai@lmarena_ai
精选
arena.ai更新了Code Arena: WebDev和Text Arena的帕累托前沿图。帕累托前沿展示了不同模型在多维性能上的最优组合。用户可据此快速比较模型,并跳转到对应排行榜查看详细数据。
推荐理由:想去arena.ai找代码或文本任务的最强模型?看这个帕累托前沿图,一眼就能知道哪些模型在权衡点上更值。
02:31
02:02
02:02官方账号Logan Kilpatrick@OfficialLoganK
Gemini 3.7 Flash 正式发布,API 价格较 3.6 Flash 降低 50%,优惠持续到年底。该模型在约三周内通过算法改进实现了显著的智能提升。它已上线 API、AI Studio 和 Antigravity 等平台。官方强调其运行速度很快。

推荐理由:Gemini 3.7 Flash 来了,比 3.6 Flash 便宜一半,速度更快,想用 API 的可以试试。
01:47
01:47lmarena.ai@lmarena_ai
Code Arena 推出 WebDev 排行榜,用于展示各模型在网页开发任务上的表现。WebDev 排行榜已通过 arena.ai 向公众开放,支持查看完整排名。Code Arena 的 WebDev 榜单为开发者在挑选模型时提供了直接对比。
推荐理由:Code Arena 搞了个 WebDev 排行榜,做网页开发选模型时可以参考排名,不用自己瞎试了。
01:45
01:43
01:43lmarena.ai@lmarena_ai
83°
xAI 的 Grok-4.6 (High) 在 Code Arena 的 WebDev 榜单以 1630 分升至第五名,超过 Claude Fable 5 的 1627 分和 GPT-5.6 Sol xHigh 的 1622 分。相比 Grok 4.5 的 1553 分(第13位),Grok-4.6 得分提升明显。目前这三款模型分差仅 4 至 9 分,分别排在第五至第七名。
事件专题

推荐理由:Grok-4.6 刚发布就把网页开发能力冲进第一梯队,分数压过 Claude 和 GPT 的最新版,差距只有个位数,写代码的可以关注下。
01:26
01:19
01:19官方账号OpenAI@OpenAI
83°
OpenAI 预览 GPT-5.6 Sol 的 Ultrafast 模式,速度最高提升至 14 倍。该模式首先在 OpenAI API 中面向一组精选客户推出,并随着容量增长向更多企业开放。官方尚未公布定价与全面开放时间。
事件专题

推荐理由:OpenAI 出了个 GPT-5.6 Sol 极速版,快 14 倍,先在 API 给一小部分客户用,后面会铺开。
00:50
00:50官方账号Decoder@Jonathan Kemper
DeepSeek将旗舰模型V4-Pro从测试阶段转为正式发布,同时以MIT许可证开源了智能体软件Harness v0.1。API价格同步上调,缓存命中成本涨至原来的6倍。对于反复读取相同文件的智能体工作流,这是价格涨幅最大的部分。

推荐理由:DeepSeek把V4 Pro转正,开源了Harness v0.1,但缓存涨价到6倍,跑智能体工作流得多算算账。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。