7月10日
02:57
02:49
02:49官方账号OpenAI@OpenAI
91°
OpenAI发布GPT-5.6 Sol模型,在编码、知识工作、网络安全和科学领域实现最先进性能。该模型使用更少token并降低计算成本。相比前代,它在多个基准测试中表现更优,但具体数字未公开。
事件专题

推荐理由:OpenAI新出的GPT-5.6 Sol能在编程、科研等领域做到顶尖,还省token省成本,想尝鲜的可以试试。
02:46
02:46Lovable@lovable_dev
精选
Lovable 宣布集成 OpenAI 的 GPT-5.6 模型。相比此前模型,GPT-5.6 在构建生产级应用的长复杂工作流中,步骤减少约 25%,工具调用次数降低 35% 至 48%。项目成功率有所提升,卡住运行的几率降低 15%。
事件专题

推荐理由:Lovable 上了 GPT-5.6,跑复杂项目更快了,步数省四分之一,工具调用少四成,卡壳也少了,效率党可以试试。
01:57
00:10
7月9日
23:47
22:59
22:34
22:34官方账号Meta AI@AIatMeta
Meta 今日推出 Muse Spark 1.1,这是一个专注于智能体任务和代码生成的低价模型。该模型通过 Meta Model API 和 Meta AI 提供服务。Muse Spark 1.1 的定价显著低于同类竞品,旨在降低开发者使用高级 agentic 和 coding 功能的门槛。
推荐理由:Meta 出了个叫 Muse Spark 1.1 的模型,既能当智能体又能写代码,价格还特别低,可以上手玩一下。
19:13
19:13官方账号Decoder@Matthias Bastian
精选
Databricks在其数百万行代码库上测试编程智能体,发现中国开源模型GLM 5.2性能与Anthropic的Opus 4.8相当。每任务成本GLM 5.2为1.28美元,Opus为1.94美元。Databricks计划将GLM 5.2作为日常编程工作主力。该公司认为没有单一供应商占主导地位,企业应自建基准而非依赖公共基准。
事件专题

推荐理由:Databricks选了国产开源模型GLM 5.2当默认编程引擎,每花1.28美元能干出Opus 1.94美元的活,省钱了性能还不差。
17:30
17:30Hunyuan@TXhunyuan
腾讯混元推出 Hy3,一个 295B 参数的 MoE 模型,支持 256K 上下文窗口。该模型针对编码、推理、智能体和可靠工具使用进行优化。即日起至 7 月 21 日,可通过 OpenRouter 免费使用,并可在 OpenClaw 中调用。
事件专题

推荐理由:腾讯新出的 Hy3 模型 295B 参数,256K 上下文,现在 OpenRouter 上免费到月底,编码和推理都很强,赶紧去试试。
11:11
11:10
04:29
04:27
04:27Fireworks AI@FireworksAI_HQ
精选
Fireworks AI 高级成员 Shoucong Chen 使用 GLM 5.2 Fast 模型,在 4 天内完成了原计划 1 个月的复杂 SWE 项目。该模型推理速度约 400 tokens/s,总推理成本仅 218 美元。通过 FireConnect 可在 Claude Code 中调用此模型。作者认为快速推理能减少上下文切换,提升开发效率。
推荐理由:Fireworks AI 的 GLM 5.2 Fast 跑到了 400tok/s,4 天干完一个月活,才花 218 刀。想试试在 Claude Code 里提速的,直接 FireConnect 走起。
04:26
04:26官方账号Simon Willison’s Weblog博客/媒体
Kenton Varda 宣布暂停团队使用 AI 编写 PR 和 commit 信息。他认为 AI 生成的描述只罗列代码细节,却缺失高层上下文,导致评审时反而更难理解。这与传统人工编写描述相比,效率更低。Varda 强调,开发者需要提供代码改动背后的设计意图,而非重复代码本身。
推荐理由:Kenton Varda 分享了亲身踩的坑:AI 写的 commit 信息越看越糊涂。如果你也在用 AI 辅助写代码注释,这条经验能帮你避开大坑。
00:34
00:34官方账号Greg Brockman@gdb
OpenAI 的 GPT-5.6-Sol 模型经过两个多月在 Next.js 日常开发中的测试,表现出色。它能理解架构权衡、调查复杂 issue 报告,并在修复 bug 时考虑代码库其他部分。仅需简短提示即可指导,甚至独立完成了 Next.js 服务器的大规模重构(包括测试套件、部署测试)。相关 PR 将在 Next.js 16.3 发布后合并。
事件专题

推荐理由:OpenAI 的 GPT-5.6-Sol 不只是聊天,能直接干复杂编程活了,比如自己重构 Next.js 服务器。想看看模型实际生产力有多强?这篇实测值得看。
7月8日