7月19日
18:08
18:08官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云宣布 Qwen3.8 即将发布并开源权重,模型参数规模达 2.4T。官方称其兼容领先前沿 AI 模型,综合能力仅次于 Fable 5。预览版 Qwen3.8-Max-Preview 已上线 Token Plan、Qoder 和 QoderWork 平台。用户可率先体验这一开源大模型。

推荐理由:阿里云发了 Qwen3.8,2.4T 参数即将开源,预览版现在就能在 Token Plan 上试,看看是不是真仅次于 Fable 5。
17:52
17:26
17:26berryxia@berryxia
83°
Qwen团队发布Qwen 3.8-Max-Preview模型,参数规模达2.4万亿,官方声称其性能仅次于Fable 5。该模型即将开源权重,预览版已上线Token Plan和Qoder平台,普通用户可先试用。这是继闭源顶级模型之后,又一大型开源模型的尝试。

推荐理由:阿里把2.4万亿参数的Qwen 3.8开源了,预览版现在就能玩,性能只比Fable 5差一点。想试试顶级开源大模型千万别错过。
14:07
09:53
09:53AI Will@FinanceYF5
Grok 4.5 模型参数规模为 1.5T,远低于 Kimi K3 的 2.8T 参数。但 Kimi K3 每次任务成本比 Grok 4.5 高出 3 倍。SpaceXAI 宣称在智能效率上实现突破,暗示参数更小但性能更优。若 Grok 扩至 3T 参数,效率优势可能进一步放大。
推荐理由:SpaceXAI 的 Grok 4.5 用 1.5T 参数就挑战了 2.8T 的 Kimi K3,成本还低 3 倍,看看参数效率和成本怎么平衡的。
04:12
04:12Aravind Srinivas@AravSrinivas
Together AI 在 DeepSWE 基准上对比了 Kimi K3 与 Claude Fable 5 的软件工程任务表现。结果显示,Kimi K3 以 Fable 5 约 35% 的价格实现了相同性能,且在更高 pass@k 指标上领先。该分析来自 Together AI 的 Arav Srinivas,数据基于内部测试。
事件专题

推荐理由:想省钱又要强性能?Kimi K3 在编程任务上和 Claude Fable 5 打个平手,价格只要三分之一,高要求场景还更强。
00:09
00:03
00:03@koltregaskes@koltregaskes
xAI的Grok 4.6(2T参数模型)将在下周完成初始训练。其性能可能超过Kimi K3。速度和成本与Grok 4.5相当。根据Elon Musk以往从训练完成到发布的时间,估计发布时间为9月中旬。
事件专题

推荐理由:xAI的Grok 4.6下周完成训练,号称又快又便宜,还比Kimi K3强,预计9月中旬发布,可以关注。
7月18日
22:19
22:19berryxia@berryxia
精选73°
Google更新Gemma 4,修复历史轮次处理、思考保留、工具输出延续和工具调用一致性问题。预填充速度提升25-70%。Unsloth跟进发布GGUF、MLX和NVFP4量化版本,支持本地部署。此次更新解决了Gemma之前工具调用不稳定或卡住的痛点。
事件专题

推荐理由:Google刚修了Gemma 4工具调用的老毛病,速度还快了25-70%,Unsloth立马出了量化版能本地跑,做Agent的兄弟可以试试。
11:14
11:09
11:09官方一手歸藏(guizang.ai)@op7418
74°
Claude 宣布自 7 月 20 日起,Fable 5 将长期包含在 Max 和 Team Premium 订阅计划中,限额为总使用量的 50%。Pro 和 Team Standard 用户则通过积分访问,并将一次性获得 100 美元积分。官方称此前需求难以预测,曾多次延期。此举可能是应对 OpenAI 和 Kimi K3 的竞争压力。
事件专题

推荐理由:Claude 终于把 Fable 5 长期固定进 Max 和 Team Premium 了,限额 50%,Pro 用户也有 100 美元积分补贴,比之前稳定多了。
10:00
10:00官方账号Clement Delangue@ClementDelangue
精选
Kimi k3每token价格是GPT-5.6 Sol的一半,但GPT-5.6 Sol生成所需token数仅一半,总成本相近。GPT-5.6 Sol的TPS是Kimi k3的2倍,实际任务速度快约4倍。用户指出Kimi k3性能优秀但并非超值选择。
事件专题

推荐理由:有人觉得Kimi k3便宜?其实和GPT-5.6 Sol算下来价格差不多,GPT-5.6 Sol速度还快4倍,别被误导了。
09:38
09:38官方账号Together AI@togethercompute
TogetherCompute使用DeepSWE评估了Kimi K3与Claude Fable 5在软件工程任务上的表现。Kimi K3以约35%的价格达到与Claude Fable 5相同的性能水平。在更高的pass@k指标上,Kimi K3甚至领先于Claude Fable 5。该分析为开发者提供了性价比更高的模型选择参考。
事件专题

推荐理由:如果你写代码,Kimi K3花不到一半的钱就能干和Claude Fable 5一样好的活,高通过率时还更强。
08:09
08:09OpenRouter@OpenRouterAI
Think Machines开发的Inkling模型已上线OpenRouter。该模型采用MoE架构,总参数975B、活跃参数41B。支持1M上下文长度,可处理文本、图像和音频。具备可控推理能力。
事件专题

推荐理由:Think Machines的Inkling模型很特别,总参数975B但只激活41B,还有1M上下文和多种模态支持,值得上手试试。
06:54
06:54官方账号OpenAI@OpenAI
91°
GPT-5.6 Sol在“The Last Ones”网络靶场中达到网络安全领域新SOTA。该能力已转化为实际防御效果,帮助团队在真实代码中查找、验证和修复漏洞。OpenAI将其集成到Codex Security中供用户使用。
事件专题

推荐理由:OpenAI的GPT-5.6 Sol在网络安全靶场拿了第一,还能直接帮团队修真实漏洞,试试Codex Security吧。
06:34
06:20
05:46
05:46官方一手@OpenAIDevs@OpenAIDevs
OpenAI发布GPT-5.6模型,社区开发者分享了超过10,000个使用该模型的理由。通过GPT-5.6,用户可以将产品从概念快速转化为成品。案例展示了GPT-5.6在代码生成和原型设计中的实际应用。
事件专题

推荐理由:OpenAI社区分享了用GPT-5.6开发产品的真实案例,能帮你快速把想法变成成品,效率很高。
05:18

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。