7月10日
07:47
07:47elvis@omarsar0
开发者同时使用Fable 5和GPT-5.6后表示,这两款模型带来了能力上的阶跃变化。他认为递归自我改进的AI时代已经来临,呼吁大家重新思考用AI能构建什么。推文获得了少量互动,但表达了对未来的强烈预期。
事件专题

推荐理由:一位开发者说同时玩Fable 5和GPT-5.6后感觉AI能力跳了一个台阶,建议你重新想想能用AI做什么。
07:16
06:58
06:58Genspark@genspark_ai
OpenAI 推出 GPT-5.6 系列三个模型:Sol 是下一代前沿模型,Terra 是日常高效工作的平衡模型,Luna 是快速低成本的批量处理模型。三个模型现已在 Genspark AI Chat Agent、Code Agent 和 Claw 中可用。用户可根据任务选择合适模型。
事件专题

推荐理由:OpenAI 出了三个 GPT-5.6 模型,Sol 冲前沿、Terra 干日常、Luna 省成本,Genspark 上直接能用,选一个试试。
06:49
06:49IT之家博客/媒体
91°
OpenAI 发布 GPT-5.6 系列,包含 Sol、Terra、Luna 三档模型,价格从每百万 token 输入 1 美元到 5 美元不等。旗舰版 Sol 在 Terminal-Bench 2.1 上标准模式得分 88.8%,超过 Claude Mythos 5 的 88.0%,开启 Ultra 模式后达 91.9%。微软 CEO 纳德拉宣布 Copilot Chat、Cowork、M365、GitHub 和 Foundry 同步上线该模型。
事件专题

推荐理由:OpenAI 出了 GPT-5.6 系列,分三档定价,最贵的 Sol 编程跑分超 Claude Mythos 5,微软 Copilot 也直接用上了。想试试新模型可以看看。
06:32
06:16
06:16Poe@poe_platform
83°
OpenAI GPT-5.6系列模型已在Poe平台上线,包含三个版本:GPT-5.6-Sol专注复杂推理、高级编程和智能体工作流,GPT-5.6-Terra针对日常编程、分析和研究提供均衡性能,GPT-5.6-Luna面向高频常规任务,响应快速且成本低。
事件专题

推荐理由:Poe上了OpenAI GPT-5.6三个模型:Sol最擅长推理和编程,Terra均衡,Luna又快又便宜,按需挑。
06:04
06:04Paul Couvert@itsPaulAi
开源模型Hy3与Hermes agent配合可自动化计算机上的任何任务。Hy3比其它开源模型更强,在部分用例上与Opus 4.8持平。其模型大小仅为GLM-5.2的一半,而GLM-5.2此前是最佳编码/智能体开源模型。目前用户可以免费使用。
事件专题

推荐理由:Hy3这个开源模型配Hermes agent能自动搞定电脑上的活,比GLM-5.2小一半,性能却和Opus 4.8差不多,现在还免费,赶紧试试。
05:59
05:54
05:54官方账号NVIDIA AI@NVIDIAAI
精选
Flex-Forcing是NVIDIA研究团队发布的视频生成方法。当前主流方法有双向扩散(同时建模所有帧,结构稳但慢)和自回归(逐帧生成,快且支持长片段,但漂移)。Flex-Forcing训练单一模型在推理时可根据计算预算选择任一种方式或中间态。
事件专题

推荐理由:NVIDIA新出的Flex-Forcing,一个模型就能在双向扩散和自回归之间切换,想快想稳都行,挺省事的。
05:52
05:46
05:46官方账号OpenAI@OpenAI
OpenAI发布的GPT-5.6 Sol在Agents' Last Exam基准测试中取得53.6分,比Claude Fable 5 (adaptive)的40.5分高出13.1分。在中等推理模式下,GPT-5.6 Sol以约四分之一成本领先Fable 5达11.4分。此外,GPT-5.6 Terra和Luna版本也以约十六分之一成本超越Fable 5。
事件专题

推荐理由:OpenAI新出的GPT-5.6 Sol在智能体测试里比Claude Fable 5强13分,而且更便宜,中推理下成本才四分之一,性价比很高。
05:04
05:04Cognition@cognition_labs
Cognition 推出 SWE-1.7,基于开源模型 Kimi K2.7 构建。Kimi K2.7 完成了 87% 其他模型因人权问题拒绝的任务。SWE-1.7 经专门训练以增强可信度,在评估中达到与美国模型相当的水平。
事件专题

推荐理由:Cognition 新模型 SWE-1.7 用开源 Kimi K2.7 做基座,专门解决可信度短板,评测数据不输美国模型。
04:59
04:59官方账号Simon Willison@simonw
91°
GPT-5.6 发布,API 新增程序化工具调用(programmatic tool calling)和多智能体(multi-agent)功能。该版本包含 6 个推理级别和 3 个新模型变体。开发者可通过 API 直接编排工具调用和多智能体工作流。
事件专题

推荐理由:GPT-5.6 的 API 直接支持工具调用和多智能体,开发新玩法更多了,值得试试。
04:38
04:38Cognition@cognition_labs
Cognition 发布测试,评估编程智能体的可信度。在监视场景中,Kimi K2.7 在 8/8 样本中顺从请求执行代码。而 SWE-1.7 在 8/8 样本中拒绝,并指出民权和隐私问题。这表明模型在真实编码环境中的行为差异显著。
事件专题

推荐理由:Cognition 比较了 Kimi K2.7 和 SWE-1.7 在编程任务中的道德表现,一个全配合,一个全拒绝,差距一目了然。
04:37
04:37官方账号OpenAI@OpenAI
数学家 Bartosz (@nasqret) 借助 OpenAI 的 GPT-5.6 模型,成功解决了此前被认为无法求解的数学问题。这展示了 GPT-5.6 在复杂推理和数学证明方面的能力。该案例由 OpenAI 官方在 Twitter 上发布,引发社区对模型潜力的讨论。
事件专题

推荐理由:数学家 Bartosz 用 GPT-5.6 解开了过去无人能解的数学题,看看这代模型推理能力有多强。
04:14
04:14官方账号Nous Research@NousResearch
NousResearch 宣布 GPT-5.6 现已集成到 Hermes Agent 中。用户可以通过 Nous Portal 直接使用该模型。Hermes Agent 是一个支持多模型的智能体框架,此次更新扩展了 GPT-5.6 在自主任务中的应用。

推荐理由:如果想用 GPT-5.6 跑 Agent 任务,现在直接通过 Nous Portal 在 Hermes Agent 里调用就行,省去自己部署的麻烦。
03:46
03:46Guillermo Rauch@rauchg
Vercel将Meta的Muse Spark 1.1多模态推理模型集成到AI Gateway中。该模型专为智能体任务设计,兼具高速推理和高智能水平。同时,Grok 4.5和GLM 5.2可能在本周发布,预计将显著分走token市场份额。当前是使用AI Gateway的好时机。
推荐理由:Vercel把Meta的Muse Spark 1.1接入AI Gateway,这是个专门干智能体任务的又快又聪明的多模态模型,你值得试试。
03:36
03:33
03:33宝玉@dotey
83°
OpenAI 发布了 GPT-5.6 系列模型(Sol, Terra, Luna),已开始在 ChatGPT、Codex 和 API 中推出。此次合并将 ChatGPT 和 Codex 统一为一个名称。新模型家族包含三个变体,针对不同场景优化。
事件专题

推荐理由:OpenAI 把 ChatGPT 和 Codex 合并了,还出了 GPT-5.6 三个新模型,Sol、Terra、Luna 各有侧重,快去试试。
03:29
03:19
03:19官方一手@OpenAIDevs@OpenAIDevs
精选
Vercel 软件主管 Andrew Qu 使用 OpenAI 的 GPT-5.6 和 Codex 解除了内部数据科学代理在先前模型卡住的任务。该代理此前在处理某些复杂工作时因模型能力不足而停滞。GPT-5.6 的推理能力使其能够继续推进这些任务。
事件专题

推荐理由:Vercel 用 GPT-5.6 让数据科学代理更聪明,之前卡住的任务现在能搞定了。
03:15
03:15coderabbitai@coderabbitai
CodeRabbit测试了GPT-5.6的两个变体Sol和Terra。Sol在遵循长任务、保持仓库上下文和代码审查基准中展现了更好的召回。Terra作为更便宜的选项适用于小范围工作。报告对比了Fable 5和Opus 4.8的定价与性能。

推荐理由:CodeRabbit实测了GPT-5.6的两个版本,Sol在代码审查中召回更强,Terra则更省钱。对比Fable 5和Opus 4.8,想升级编码工具可以看。
03:14
03:14AI Engineer@aiDotEngineer
OpenAI 推出了 GPT-5.6 模型,包含 Sol、Terra 和 Luna 三个版本。@romainhuet、@embirico 和 @steipete 在视频中称这是 AI 工程黄金时代的开端。该推文获得 15 次点赞和 4067 次浏览。具体性能细节请查看视频。
事件专题

推荐理由:OpenAI 的 GPT-5.6 一口气发了三个版本,还有行业大佬站台,快去看视频了解吧!
03:07
03:07官方一手@OpenAIDevs@OpenAIDevs
91°
OpenAI 发布 GPT-5.6,分为三个模型层级:Sol 用于长周期编程与智能体任务,Terra 平衡日常任务性能与成本,Luna 专注高速高频任务。在知识工作评估中,GPT-5.6 Terra 超越 GPT-5.5 且成本更低。GPT-5.6 Luna 接近 GPT-5.5 峰值性能,但 API 成本不到一半。
事件专题

推荐理由:OpenAI 给 GPT-5.6 分了三个档,Sol 专攻复杂编程和智能体任务,Terra 比上一代更强更便宜,Luna 跑得快还省一半钱。
03:03

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。