7月17日
14:47
14:47AI Will@FinanceYF5
Kimi K3 在多项任务上超越 ChatGPT 和 Claude Fable 5。用户用 Kimi K3 构建了 10 个应用案例,其中包括 Game Boy Advance 模拟器。这标志着 AI 模型竞争格局的重大转变。
事件专题

推荐理由:Kimi K3 太强,能做 Game Boy Advance 模拟器这类应用,比 ChatGPT 和 Claude Fable 5 还厉害。看看这 10 个案例就懂了。
08:33
08:33官方账号Simon Willison’s Weblog博客/媒体
精选
Simon Willison基于Grok Build的Rust代码创建了Mermaid转ASCII工具,随后发现AlexanderGrooff开发的Go库mermaid-ascii功能更全。他用Claude Fable 5将Go库编译为WebAssembly,以比较两个版本的输出。Go版额外支持颜色输出。
事件专题

推荐理由:Simon用Claude Fable 5把Go版的Mermaid转ASCII编译成了WebAssembly,还能显示颜色,跟Rust版对比着玩,挺有意思。
04:17
04:17lmarena.ai@lmarena_ai
精选72°
Kimi K3 在 Code Arena 前端榜单以 1679 分超越 Claude Fable 5 升至第一,排名从 Kimi-k2.6 的第 18 位跃升 17 位。在 Brand & Marketing、Reference-Based Design 等 6 个领域排名第一,仅在 Gaming 领域落后 Fable 5 列第二。模型权重将于 7 月 27 日开源。
事件专题

推荐理由:Kimi 新模型在前端代码上把 Claude Fable 5 比下去了,六个子项都排第一,而且权重会开源,值得试试。
04:00
04:00官方账号Decoder@Matthias Bastian
Kimi发布名为K3的多模态开放权重模型,拥有2.8万亿参数和100万token上下文。在自有基准测试中,K3接近GPT-5.6 Sol和Claude Fable 5,并显著超过Opus 4.8和GLM 5.2。该模型定价大幅高于前代,标志着中国AI低价时代可能结束。完整权重计划于7月27日前公开发布。
事件专题

推荐理由:Kimi搞了个2.8万亿参数的开源模型K3,性能追平GPT-5.6 Sol和Claude Fable 5,不过价格也上去了,中国AI要涨钱了。
03:27
03:27lmarena.ai@lmarena_ai
精选78°
Kimi_Moonshot 发布的 Kimi-K3 模型在 Frontend Code Arena 中以 1679 分排名第一,超越 Claude Fable 5。相比此前第 18 名的 Kimi-k2.6 跃升 17 位。在 Brand & Marketing 等 6 个领域中均排名第一,仅 Gaming 领域位居第二。完整模型权重将于 7 月 27 日前开源。
事件专题

推荐理由:Kimi-K3 刚把 Claude Fable 5 从第一拉下来,前端代码评测全面领先,很快还会开源权重,玩编程的可以关注。
7月16日
07:03
07:03Fireworks AI@FireworksAI_HQ
Doximity Ask由Doximity开发,基于Fireworks平台训练。在Stanford Arise Lab的独立评估中,它超越GPT-5.6 Sol、Claude Fable 5、OpenEvidence等24个模型。该研究涉及12,747个专家评级,针对真实临床问题。结果表明专用临床模型在安全性上更优。
事件专题

推荐理由:Doximity Ask在独立测试中把GPT-5.6和Claude Fable 5都干翻了,说明医学领域专用模型才是王道。
7月14日
7月13日
16:24
16:24官方账号Decoder@Matthias Bastian
Anthropic将Claude Fable 5的免费访问延长至2026年7月19日,原本该模型于今日切换为按使用付费。订阅者每周可将50%的使用额度用于Fable 5。此举是对OpenAI GPT-5.6 Sol及更便宜竞品定价压力的回应。
事件专题

推荐理由:Anthropic把Claude Fable 5免费延期到明年7月,订阅用户还能用一半额度,主要因为OpenAI的GPT-5.6 Sol打价格战了。
11:42
09:05
09:05官方账号Greg Brockman@gdb
87°
OpenAI的GPT-5.6 Sol在Design Arena中以Elo 1353排名第一,超过Anthropic的Claude Fable 5。它和智谱的GLM 5.2处于同一性能区间(前端设计)。相比GPT-5.5,GPT-5.6 Sol提升了18个名次和60分Elo。该模型还建立了偏好与速度的新帕累托前沿,比同性能级别模型更快。
事件专题

推荐理由:OpenAI新模型GPT-5.6 Sol在网页设计评测中拿了第一,比上一代强很多,还比Claude Fable 5更快。想看看AI设计的新天花板吗?
05:34
7月11日
7月10日
19:58
19:22
19:22官方账号Decoder@Maximilian Schreiner
76°
Bun这个JavaScript工具已从Zig完全重写为Rust,整个过程借助了Anthropic的Claude Fable 5模型。Fable 5在11天内生成了超过一百万行代码,完成了整个重写工作。这次重写展示了Claude Fable 5在大型代码迁移任务中的效率。Bun团队尚未公布具体性能对比数据,但表示新版本已通过测试。
事件专题

推荐理由:Bun原来用Zig写的,现在直接换成Rust了,而且靠Claude Fable 5在11天里写了100多万行代码,这AI写代码的效率太吓人了。
10:58
05:46
05:46官方账号OpenAI@OpenAI
OpenAI发布的GPT-5.6 Sol在Agents' Last Exam基准测试中取得53.6分,比Claude Fable 5 (adaptive)的40.5分高出13.1分。在中等推理模式下,GPT-5.6 Sol以约四分之一成本领先Fable 5达11.4分。此外,GPT-5.6 Terra和Luna版本也以约十六分之一成本超越Fable 5。
事件专题

推荐理由:OpenAI新出的GPT-5.6 Sol在智能体测试里比Claude Fable 5强13分,而且更便宜,中推理下成本才四分之一,性价比很高。
7月9日
09:04