14:47AI Will@FinanceYF5Kimi K3 在多项任务上超越 ChatGPT 和 Claude Fable 5。用户用 Kimi K3 构建了 10 个应用案例,其中包括 Game Boy Advance 模拟器。这标志着 AI 模型竞争格局的重大转变。AI模型Kimi K3ChatGPTClaude Fable 510 个信源在谈事件专题推荐理由:Kimi K3 太强,能做 Game Boy Advance 模拟器这类应用,比 ChatGPT 和 Claude Fable 5 还厉害。看看这 10 个案例就懂了。原文稍后读已读值得跟进有用关注 Kimi K3
10:49orange.ai@oran_geMoonshot AI 的 Kimi K3 在内部写作基准中以 2840 Elo 排名第一,超越 Claude Fable 5。相比前代 Kimi K2.6,排名从第 21 跃升至第 1。每个脚本运行成本约 0.25 美元,比被超越的模型便宜 5 倍。这是首个开放权重模型在该基准登顶。AI模型Kimi K3Claude Fable 5Moonshot AI10 个信源在谈事件专题推荐理由:Moonshot AI 的 Kimi K3 在写作评测上干掉了 Claude Fable 5,成本还低 5 倍,开源模型也能这么强?原文稍后读已读值得跟进有用关注 Kimi K3
10:48orange.ai@oran_ge73°Kimi-K3在Frontend Code Arena中以1679分排名第一,超越Claude Fable 5。该模型从Kimi-k2.6的第18位跃升17个名次至榜首。在7个前端域中,Kimi-K3在6个领域(品牌营销、参考设计、数据分析、消费产品、模拟、内容创作工具)排名第一,仅在游戏领域落后于Fable 5位列第二。完整模型权重将于7月27日开源。AI模型Kimi-K3Kimi_MoonshotClaude Fable 510 个信源在谈事件专题推荐理由:月之暗面新模型Kimi-K3在代码排行榜上干掉了Claude Fable 5,六个子项第一,还承诺开源,看看能不能打。原文稍后读已读值得跟进有用关注 Kimi-K3
09:54Amjad Masad@amasad76°Kimi-Moonshot 的蒸馏模型 Kimi-K3 在 Frontend Code Arena 中获得 1679 分,排名第一,超越此前领先的 Claude Fable 5。相比前代 Kimi-k2.6(第 18 名),Kimi-K3 跃升 17 个位次。在 7 个前端评测领域中,Kimi-K3 在 Brand & Marketing、Reference-Based Design 等 6 个领域取得第一,仅在 Gaming 领域落后于 Fable 5。完整模型权重将于 7 月 27 日前开源。AI模型Kimi-K3Claude Fable 5Kimi_Moonshot10 个信源在谈事件专题推荐理由:Kimi-Moonshot 的蒸馏模型 Kimi-K3 在前端编码基准上直接干翻了 Claude Fable 5,还开源权重,值得关注。原文稍后读已读值得跟进有用关注 Kimi-K3
08:33官方账号Simon Willison’s Weblog(博客/媒体)精选Simon Willison基于Grok Build的Rust代码创建了Mermaid转ASCII工具,随后发现AlexanderGrooff开发的Go库mermaid-ascii功能更全。他用Claude Fable 5将Go库编译为WebAssembly,以比较两个版本的输出。Go版额外支持颜色输出。技巧Claude Fable 5MermaidWebAssembly10 个信源在谈事件专题推荐理由:Simon用Claude Fable 5把Go版的Mermaid转ASCII编译成了WebAssembly,还能显示颜色,跟Rust版对比着玩,挺有意思。原文稍后读已读值得跟进有用关注 Claude Fable 5
08:05lmarena.ai@lmarena_aiKimi-K3在Frontend Code Arena中以76%的pairwise win rate排名第一,击败Claude Fable 5(63%)和GPT-5.6 Sol(58%)。该模型获得1679分,从第18位跃升至第1位。在品牌营销、参考设计、数据分析等6个领域均排名第一,仅游戏领域落后于Fable 5。Kimi-Moonshot团队将于7月27日前开源完整模型权重。AI模型Kimi-K3Claude Fable 5GPT-5.6 Sol10 个信源在谈事件专题推荐理由:Kimi-K3刚在代码前端评测中干翻Claude Fable 5,76%胜率,6个领域第一,权重还开源,绝对值得关注。原文稍后读已读值得跟进有用关注 Kimi-K3
04:17lmarena.ai@lmarena_ai精选72°Kimi K3 在 Code Arena 前端榜单以 1679 分超越 Claude Fable 5 升至第一,排名从 Kimi-k2.6 的第 18 位跃升 17 位。在 Brand & Marketing、Reference-Based Design 等 6 个领域排名第一,仅在 Gaming 领域落后 Fable 5 列第二。模型权重将于 7 月 27 日开源。AI模型Kimi K3Kimi_MoonshotClaude Fable 510 个信源在谈事件专题推荐理由:Kimi 新模型在前端代码上把 Claude Fable 5 比下去了,六个子项都排第一,而且权重会开源,值得试试。原文稍后读已读值得跟进有用关注 Kimi K3
04:00官方账号Decoder@Matthias BastianKimi发布名为K3的多模态开放权重模型,拥有2.8万亿参数和100万token上下文。在自有基准测试中,K3接近GPT-5.6 Sol和Claude Fable 5,并显著超过Opus 4.8和GLM 5.2。该模型定价大幅高于前代,标志着中国AI低价时代可能结束。完整权重计划于7月27日前公开发布。AI模型KimiK3GPT-5.6 Sol10 个信源在谈事件专题推荐理由:Kimi搞了个2.8万亿参数的开源模型K3,性能追平GPT-5.6 Sol和Claude Fable 5,不过价格也上去了,中国AI要涨钱了。原文稍后读已读值得跟进有用关注 Kimi
03:27lmarena.ai@lmarena_ai精选78°Kimi_Moonshot 发布的 Kimi-K3 模型在 Frontend Code Arena 中以 1679 分排名第一,超越 Claude Fable 5。相比此前第 18 名的 Kimi-k2.6 跃升 17 位。在 Brand & Marketing 等 6 个领域中均排名第一,仅 Gaming 领域位居第二。完整模型权重将于 7 月 27 日前开源。AI模型Kimi-K3Kimi_MoonshotClaude Fable 510 个信源在谈事件专题推荐理由:Kimi-K3 刚把 Claude Fable 5 从第一拉下来,前端代码评测全面领先,很快还会开源权重,玩编程的可以关注。原文稍后读已读值得跟进有用关注 Kimi-K3
12:09Viking@vikingmutereactbench.com 是专门针对 React 编码的真实基准测试,包含 51 个真实任务,均来自开源项目实际 PR 和 Issue。测试结果显示 GPT-5.6 Sol xHigh 综合表现最强,成本仅 1.43 美元。GPT-5.6 Terra Medium 性价比最佳,成本 0.53 美元,而 Claude Fable 5 成本高达 9.05 美元,约为 Sol 的 6-7 倍。AI模型reactbenchGPT-5.6Claude Fable 510 个信源在谈事件专题推荐理由:百万.js 作者搞了个 React 编码实测,51个真实任务,GPT 5.6 最便宜最强,Claude 太贵了。原文稍后读已读值得跟进有用关注 reactbench
07:03Fireworks AI@FireworksAI_HQDoximity Ask由Doximity开发,基于Fireworks平台训练。在Stanford Arise Lab的独立评估中,它超越GPT-5.6 Sol、Claude Fable 5、OpenEvidence等24个模型。该研究涉及12,747个专家评级,针对真实临床问题。结果表明专用临床模型在安全性上更优。AI模型Doximity AskFireworks临床AI10 个信源在谈事件专题推荐理由:Doximity Ask在独立测试中把GPT-5.6和Claude Fable 5都干翻了,说明医学领域专用模型才是王道。原文稍后读已读值得跟进有用关注 Doximity Ask
00:43lmarena.ai@lmarena_ai精选Arena 推出基于人类偏好和事实性加权组合的新排名。系统随机抽取对战并提取网络可验证声明,已标注超 200 万条声明(Text Arena 130 万+,Search Arena 70 万+)。启用事实性后,Claude Fable 5 降至第 2,GPT-5.5 跃升 13 位至第 7,Muse Spark 跌 13 位至第 20。Meta 整体排名从第 2 跌至第 5,Anthropic 仍居榜首,开源模型中 Xiaomi 从第 9 升至第 6。AI模型Arena事实性Claude Fable 510 个信源在谈事件专题推荐理由:以后看模型排名不只凭喜好,还能按事实准确性排序。GPT-5.5 狂飙 13 名,Claude 也被挤到第二,快去 Arena 开开关看看。原文稍后读已读值得跟进有用关注 Arena
09:10官方一手arXiv: Anthropic@Dominic Okonkwo, Magnus Hodgson, Temitope I. David, Susan Adanna Ihejirika这篇论文评估了Anthropic最先进的模型Claude Fable 5在8个生物医学基准(4个文本+4个多模态)上的表现,并与Claude前辈和GPT-5进行了对比。研究发现Fable 5的拒绝率在8.0%到99.4%之间,具体取决于基准(如MedQA、MedXpertQA MM、RareBench),这一模式在先前模型和GPT-5中均不存在。一旦排除被拒绝的问题,Fable 5在所有基准上的准确率都超过或持平其他模型。论文识别出两种不同的拒绝模式:一种集中在基础科学和机制内容,另一种在RareBench上针对先天代谢疾病几乎全部拒绝,而成人自身免疫疾病则没有。论文Claude Fable 5AnthropicGPT-510 个信源在谈事件专题推荐理由:这篇论文很有意思,告诉你Claude Fable 5在医学难题上不是不会答,而是经常拒绝回答。一旦它愿意回答,准确率反而是最高的。如果你想了解模型的安全边界和真实能力,值得看看。原文稍后读已读值得跟进有用关注 Claude Fable 5
06:35宝玉@dotey73°Agent Arena 基于 7.8K 真实世界的 agent 会话评测,GPT-5.6 Sol 位居第2,相比 GPT-5.5 (xHigh) 净提升 +1.6%,缩小了与领先的 Claude Fable 5 的差距。关键信号“Praise vs Complaint”显示 Claude Fable 5 得分为 +17.3%,高于 GPT-5.6 Sol 的 +10.9%。该排行榜由 Arena.ai 维护,通过数百万个长期 agent 任务测量模型表现,并采用因果追踪方法计算相对于平均模型的结果。AI模型GPT-5.6 SolClaude Fable 5OpenAI10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 Sol 在 Agent Arena 上冲到第2,离 Claude Fable 5 更近了。看看具体指标差异,特别是用户满意度的信号。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
16:24官方账号Decoder@Matthias BastianAnthropic将Claude Fable 5的免费访问延长至2026年7月19日,原本该模型于今日切换为按使用付费。订阅者每周可将50%的使用额度用于Fable 5。此举是对OpenAI GPT-5.6 Sol及更便宜竞品定价压力的回应。行业Claude Fable 5GPT-5.6 SolAnthropic10 个信源在谈事件专题推荐理由:Anthropic把Claude Fable 5免费延期到明年7月,订阅用户还能用一半额度,主要因为OpenAI的GPT-5.6 Sol打价格战了。原文稍后读已读值得跟进有用关注 Claude Fable 5
14:21IT之家(博客/媒体)72°OpenAI正式向所有用户开放GPT-5.6系列三款模型(Sol、Terra、Luna),流量达到此前峰值两倍。为缓解压力,OpenAI临时取消ChatGPT Plus、Business和Pro订阅用户每5小时的使用限额,并对GPT-5.6 Sol部署推理优化,使可用额度提升约10%。约50万名ChatGPT Work和Codex用户获得Banked Reset功能,该功能已扩展至网页版和移动端。Anthropic将Claude Fable 5推广活动延长至7月19日,并维持Claude Code每周使用额度提高50%的优惠。AI产品GPT-5.6 SolOpenAIAnthropic10 个信源在谈事件专题推荐理由:OpenAI给GPT-5.6 Sol做了优化,额度多了10%,还取消了每5小时限额;Anthropic的Fable 5延期了,想体验Claude高级模型要抓紧。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
11:42Claude@claudeai精选86°Claude AI宣布所有付费计划用户将延长访问Claude Fable 5的权限。同时,Claude Code的每周速率限制维持在提高50%的水平。这些变动有效至7月19日。AI产品ClaudeClaude Fable 5Claude Code10 个信源在谈事件专题推荐理由:Claude用户抓紧了,Fable 5权限和Code的高速率都延续到7月19日,赶紧用起来。原文稍后读已读值得跟进有用关注 Claude
09:05官方账号Greg Brockman@gdb87°OpenAI的GPT-5.6 Sol在Design Arena中以Elo 1353排名第一,超过Anthropic的Claude Fable 5。它和智谱的GLM 5.2处于同一性能区间(前端设计)。相比GPT-5.5,GPT-5.6 Sol提升了18个名次和60分Elo。该模型还建立了偏好与速度的新帕累托前沿,比同性能级别模型更快。AI模型GPT-5.6 SolOpenAIClaude Fable 510 个信源在谈事件专题推荐理由:OpenAI新模型GPT-5.6 Sol在网页设计评测中拿了第一,比上一代强很多,还比Claude Fable 5更快。想看看AI设计的新天花板吗?原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
08:27shao__meng@shao__mengShoumeng 分享了为 Claude Fable 5 设计成本高效 Harness 的思路,核心是利用 token 维度上的智能不对称——少数 token 需要前沿模型,多数只需廉价执行。三种分配模式分别是编排者(委派 worker)、顾问(被低阶执行者咨询)和验证者(检查产出)。实验一 Parameter Golf 中,Fable 5 作顾问 + Sonnet 5 作执行者,以 34% token 成本达到 Fable 独跑约 90% 的增益。实验二 BrowseComp 完整集(~31M tokens/题)中,Fable 编排 + Sonnet worker 实现 96% 分数 / 46% 成本。文章总结了四条设计准则:审视任务形状、使用委派启发式、评估协调成本、保证 prompt cache 命中。技巧Claude Fable 5GPT-5.6 SolSonnet 510 个信源在谈事件专题推荐理由:Shoumeng 教你用 Fable 5 搭配 Sonnet 5 做 Harness,34% 成本拿 90% 效果,适合想省 token 又不降智能的人。原文稍后读已读值得跟进有用关注 Claude Fable 5
05:34官方账号Simon Willison’s Weblog(博客/媒体)Anthropic 再次延长 Claude Fable 5 的可用期限至 7 月 19 日。付费用户可在 Claude Max 计划中使用该模型,每周使用量上限的 50% 可分配给 Fable 5。同时 Claude Code 的周速率限制继续维持在 50% 的更高水平。OpenAI 对 GPT-5.6 Sol 未采取类似的访问限制。作者建议 Anthropic 永久保留 Fable 以避免用户流失。AI产品Claude Fable 5AnthropicOpenAI10 个信源在谈事件专题推荐理由:Anthropic 又把 Fable 的可用时间延到 7 月 19 日了,OpenAI 的 GPT-5.6 却无需限制,Anthropic 该考虑永久开放了。原文稍后读已读值得跟进有用关注 Claude Fable 5
07:00AI Will@FinanceYF573°ArenaAI 数据显示,OpenAI 的 GPT-5.6 Sol 在 Code Arena: Frontend 基准上与 Anthropic 的 Claude Fable 5 并列第一。这是 OpenAI 模型首次登上 Code Arena 榜首。该基准主要评估 Agentic Coding、前端开发和 Web App 构建能力。AI模型GPT-5.6 SolClaude Fable 5OpenAI10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 Sol 在代码前端基准上追平了 Claude Fable 5,前端能力进步很明显,做网页的可以留意。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
06:59AI Will@FinanceYF5精选73°OpenAI 的 GPT-5.6-sol 在 Code Arena: Frontend 中跃升至第一,与 Claude Fable 5 并列。该模型从之前的第 18 名大幅提升至第 1 名,并在 Data & Analytics、Brand Marketing、Consumer product 和 Gaming 类别中均排名第一。定价为 $5/$30 每百万输入/输出 Token,大约是 Claude Fable 5 价格的一半。这是 OpenAI 模型首次在 Code Arena 中取得最高排名。AI模型GPT-5.6-solOpenAIClaude Fable 510 个信源在谈事件专题推荐理由:OpenAI终于登顶了!GPT-5.6-sol在代码竞技场和Claude Fable 5打成平手,价格还便宜一半,搞前端开发的快来看看。原文稍后读已读值得跟进有用关注 GPT-5.6-sol
15:37IT之家(博客/媒体)86°开发者 Jarred Sumner 利用 Anthropic 的 Claude Fable 5 模型,在 11 天内将 JavaScript 运行时 Bun 从 Zig 语言重写为 Rust,生成了超过 100 万行代码。重构目的是提升可靠性,Zig 频繁出现内存错误,而 Rust 能在编译时捕获此类问题。过程中 64 个 Claude 实例并行运行,API 费用约 16.5 万美元(约 111.9 万元人民币)。Bun 团队已于 2025 年 12 月被 Anthropic 收购。重构后的 Bun v1.4.0 Canary 版本修复了 128 个错误,运行速度提高 2% 到 5%。AI模型Claude Fable 5BunRust10 个信源在谈事件专题推荐理由:Anthropic 的 Claude Fable 5 太能干了,11 天帮 Bun 重写超百万行 Rust 代码,修了 128 个 bug 还提速 5%,顶一支团队干一年。原文稍后读已读值得跟进有用关注 Claude Fable 5
09:22SuperTechFans(博客/媒体)92°GPT-5.6 Sol 在 Agents' Last Exam 上得分 53.6,领先 Claude Fable 5 达 13.1 分。中等推理模式下仅用约四分之一成本即领先 11.4 分。Terra 和 Luna 以约十六分之一成本超越 Fable 5。在 Artificial Analysis Coding Agent Index 上 Sol 取得 80 分,领先 Fable 5 2.8 分,token 和成本大幅降低。新推出 ultra 模式默认协调四个智能体并行工作,提升浏览和证券基准表现。安全方面经过广泛红队测试和自动化评估。AI模型GPT-5.6OpenAIClaude Fable 510 个信源在谈事件专题推荐理由:OpenAI 刚发了 GPT-5.6,三个型号性能都爆表,尤其 Sol 在编码和推理测试里吊打 Claude Fable 5,成本还低很多,编程和复杂任务都更强了。原文稍后读已读值得跟进有用关注 GPT-5.6
05:30lmarena.ai@lmarena_aiGPT-5.6-Sol-xHigh 在 Code Arena: Frontend 基准测试中达到 1636 分,位于 Pareto 前沿。其混合价格为 23.75 美元/百万 token(输入 5 美元,输出 30 美元),比 Claude Fable 5 便宜 40%,性能大致相当。这一结果表明该模型在成本效率上具有显著优势。AI模型GPT-5.6-Sol-xHighCode ArenaClaude Fable 510 个信源在谈事件专题推荐理由:GPT-5.6-Sol-xHigh 在 Code Arena 前端拿了 1636 分,还比 Claude Fable 5 便宜 40%,性价比突出。原文稍后读已读值得跟进有用关注 GPT-5.6-Sol-xHigh
05:25lmarena.ai@lmarena_ai88°OpenAI的GPT-5.6-sol在Code Arena: Frontend中取得并列第一的成绩,追平Claude Fable 5。这是OpenAI模型首次在该基准中夺冠,相较于前代GPT-5.5-xhigh从第18名跃升至第1名。该模型在Data & Analytics、Brand Marketing、Consumer product和Gaming四个子类别中均排名第一。定价为每百万输入/输出token分别5美元/30美元,约为Claude Fable 5的一半。AI模型GPT-5.6-solClaude Fable 5OpenAI10 个信源在谈事件专题推荐理由:OpenAI发了GPT-5.6-sol,代码能力直接冲到第一,还比Claude便宜一半,搞前端开发的可以试试。原文稍后读已读值得跟进有用关注 GPT-5.6-sol
19:58Geek@geekbb一条推文提出GPT 5.6、Grok 4.5、GLM 5.2三款模型的组合能否超越Claude Fable 5的问题。该推文获得1599次查看和2次投票。评论区有2条讨论,目前尚无定论。AI模型GPT 5.6Grok 4.5GLM 5.28 个信源在谈事件专题推荐理由:看看网友在聊GPT 5.6、Grok 4.5、GLM 5.2和Claude Fable 5谁更强,挺有意思的。原文稍后读已读值得跟进有用关注 GPT 5.6
19:22官方账号Decoder@Maximilian Schreiner76°Bun这个JavaScript工具已从Zig完全重写为Rust,整个过程借助了Anthropic的Claude Fable 5模型。Fable 5在11天内生成了超过一百万行代码,完成了整个重写工作。这次重写展示了Claude Fable 5在大型代码迁移任务中的效率。Bun团队尚未公布具体性能对比数据,但表示新版本已通过测试。AI模型BunRustClaude Fable 510 个信源在谈事件专题推荐理由:Bun原来用Zig写的,现在直接换成Rust了,而且靠Claude Fable 5在11天里写了100多万行代码,这AI写代码的效率太吓人了。原文稍后读已读值得跟进有用关注 Bun
13:03AI Will@FinanceYF5在 Artificial Analysis Coding Agent Index 上,GPT-5.6 Sol 以 80.0 分刷新最高纪录,比 Claude Fable 5 的分数高出 2.8 分。GPT-5.6 Sol 的输出 Token 少于 Claude Fable 5 的一半,耗时也少于一半。其成本约低三分之一。这项成绩体现了 GPT-5.6 Sol 在编码智能体任务上的效率优势。AI模型GPT-5.6 SolClaude Fable 5Artificial Analysis Coding Agent Index9 个信源在谈事件专题推荐理由:GPT-5.6 Sol 这次在编程智能体评测上确实猛,分数更高还更快更便宜,值得看看。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
12:56AI Will@FinanceYF586°GPT-5.6 Sol 在 Agents' Last Exam 测试中得分 53.6,比 Claude Fable 5(adaptive)高出 13.1 分。在中等推理强度下,GPT-5.6 Sol 仍比 Fable 5 高出 11.4 分,预估成本约为后者的四分之一。GPT-5.6 Terra 和 Luna 版本也在约十六分之一成本下超过 Fable 5。AI模型GPT-5.6Claude Fable 5Agents' Last Exam9 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 新系列在智能体考试中大幅领先 Claude Fable 5,成本还低很多,值得看看。原文稍后读已读值得跟进有用关注 GPT-5.6
10:58Geek@geekbbClaude Fable 5、OpenAI GPT-5.6、Grok 4.5、Meta Muse Spark 1.1 和 Hy3 五个新模型被同时提及。这些模型分别来自 Anthropic、OpenAI、xAI、Meta 等主流厂商。目前尚无各模型的详细参数或基准成绩。市场关注度极高,相关帖子浏览量已超 1100。AI模型Claude Fable 5GPT-5.6Grok 4.510 个信源在谈事件专题推荐理由:Anthropic、OpenAI、xAI、Meta 一口气发了五个新模型,名称和版本号都列出来了,赶紧看看都有谁。原文稍后读已读值得跟进有用关注 Claude Fable 5
05:57官方账号OpenAI@OpenAI88°OpenAI 发布 GPT-5.6 Sol,在 Artificial Analysis Coding Agent Index 上取得 80.0 分,比此前 SOTA Claude Fable 5 高出 2.8 分。该模型输出 token 数不到一半,运行时间缩短一半以上,成本降低约三分之一。这是编码智能体领域的新标杆。AI模型GPT-5.6 SolOpenAIClaude Fable 510 个信源在谈事件专题推荐理由:OpenAI 新模型 GPT-5.6 Sol 真强,编码基准甩开 Claude Fable 5,还更快更便宜。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
05:46官方账号OpenAI@OpenAIOpenAI发布的GPT-5.6 Sol在Agents' Last Exam基准测试中取得53.6分,比Claude Fable 5 (adaptive)的40.5分高出13.1分。在中等推理模式下,GPT-5.6 Sol以约四分之一成本领先Fable 5达11.4分。此外,GPT-5.6 Terra和Luna版本也以约十六分之一成本超越Fable 5。AI模型GPT-5.6 SolClaude Fable 5OpenAI10 个信源在谈事件专题推荐理由:OpenAI新出的GPT-5.6 Sol在智能体测试里比Claude Fable 5强13分,而且更便宜,中推理下成本才四分之一,性价比很高。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
03:49官方账号Simon Willison’s Weblog(博客/媒体)82°OpenAI发布GPT-5.6三款模型Luna、Terra、Sol,定价分别为每百万token $1/$6、$2.50/$15、$5/$30。在Agents' Last Exam基准上,Sol以53.6分领先Claude Fable 5(自适应推理)13.1分,Terra和Luna以约1/16成本超越Fable 5。但在SWE-Bench Pro上Fable 5得80%,Sol仅64.6%。OpenAI近期发文质疑该基准约30%任务存在问题。新API支持程序化工具调用、多智能体协作和显式提示缓存断点。AI模型GPT-5.6OpenAIClaude Fable 510 个信源在谈事件专题推荐理由:GPT-5.6家族上线:Luna平价,Sol推理强,但真实编码表现不及Claude Fable 5,且新增多智能体API。原文稍后读已读值得跟进有用关注 GPT-5.6
15:04IT之家(博客/媒体)精选Anthropic 官方推荐将 Claude Fable 5 作为规划层、Sonnet 5 作为执行层来降低使用成本。在顾问模式下,Sonnet 5 主执行,必要时才调 Fable 5,在 SWE-bench Pro 基准上达到 Fable 5 单独运行 92% 性能,成本仅 63%。在协调者模式下,Fable 5 分配子任务给多个 Sonnet 5 智能体,在 BrowseComp 基准上实现 96% 性能,成本为 46%。技巧Claude Fable 5Sonnet 5Anthropic10 个信源在谈事件专题推荐理由:Anthropic 教你两种搭配方案,用便宜好用的 Sonnet 5 分担大部分活,成本降到一半甚至更低,性能几乎不掉。原文稍后读已读值得跟进有用关注 Claude Fable 5
14:50IT之家(博客/媒体)精选Artificial Analysis 新增 6 个行业指数测试,Claude Fable 5 在全部 8 项指标中排名第一。Claude Opus 4.8 六项第二,GPT-5.5 xhigh 拿下剩余两项第二。开放权重模型 GLM-5.2 在 5 个行业指数中领先,工程基准得 53 分。成本方面,Claude Fable 5 在战略与运营指数中每任务成本 3.48 美元,是 DeepSeek V4 Pro max(0.03 美元)的 116 倍,性能仅高 12 分。DeepSeek V4 Flash 成本低于 0.04 美元,得分处于中游。AI模型Claude Fable 5DeepSeek V4 ProGPT-5.510 个信源在谈事件专题推荐理由:想选行业AI模型?Claude Fable 5 碾压全场,但成本是 DeepSeek V4 Pro 的百倍,性能只多 12 分,性价比得掂量。原文稍后读已读值得跟进有用关注 Claude Fable 5
09:04爱范儿@郑廷旭GPT-5.6 定于本周全量上线。Claude Fable 5 免费使用期延长至 7 月 12 日。SpaceX 股价跌破上市首日开盘价。AI模型GPT-5.6Claude Fable 5SpaceX10 个信源在谈事件专题推荐理由:今天早报有GPT-5.6上线、Claude Fable 5免费延长、SpaceX股价破发,三条短讯快速掌握动态。原文稍后读已读值得跟进有用关注 GPT-5.6
00:22官方账号Decoder@Matthias BastianAnthropic 的 Claude Fable 5 在 Artificial Analysis 发布的六个新行业基准(金融、法律、医学)中全部获得最高分。在 Strategy & Ops Index 中,Fable 5 单次任务成本 3.48 美元,是 DeepSeek V4 Pro 的 0.03 美元的 100 倍以上,但分数仅领先 12 分。这表明顶级推理性能以极高的使用成本为代价。AI模型Claude Fable 5AnthropicDeepSeek V4 Pro10 个信源在谈事件专题推荐理由:Claude 5 性能确实最强,但用一次要三块多,比 DeepSeek 贵百倍,分数只高一点,性价比要好好掂量。原文稍后读已读值得跟进有用关注 Claude Fable 5
18:22AI Will@FinanceYF5Anthropic 近期重新开放了 Claude Fable 5 模型。该模型引发社区热议,用户已创造出10个创意应用示例。示例覆盖多种使用方向,展示了 Fable 5 的生成与推理能力。具体基准表现尚未公布,但社区反响强烈。AI模型AnthropicClaude Fable 5智能体10 个信源在谈事件专题推荐理由:Anthropic 重新上线 Claude Fable 5,社区立马玩出10种骚操作,想看看怎么用?原文稍后读已读值得跟进有用关注 Anthropic
15:22小互@imxiaohu马斯克称SpaceXAI将于明天向公众发布Grok 4.5。OpenAI宣布GPT-5.6 Sol将与Terra和Luna一同于本周四公开推出。Anthropic将Claude Fable 5的访问权限延长至7月12日。Google也预告了Gemini 3.5 Pro。多个厂商集中在同一时段发布新模型。AI模型Grok 4.5GPT-5.6 SolClaude Fable 510 个信源在谈事件专题推荐理由:多家AI公司扎堆预告新模型,Grok 4.5、GPT-5.6 Sol、Claude Fable 5这些名字你都得知道。原文稍后读已读值得跟进有用关注 Grok 4.5