14:34官方账号Simon Willison’s Weblog(博客/媒体)76°Anthropic 宣布自7月20日起,Claude Fable 5 将包含在 Max 和 Team Premium 订阅计划中,使用限额为50%。Pro 和 Team Standard 用户可通过使用积分继续访问 Fable,并获得一次性100美元信用额度。此前 Anthropic 计划将 Fable 5 从订阅中移除并仅通过 API 提供,但受到 GPT-5.6 Sol 和 Kimi 3 的竞争压力而改变原计划。公司称调整源于计算容量担忧。行业Claude Fable 5AnthropicGPT-5.6 Sol10 个信源在谈事件专题推荐理由:Anthropic 把 Fable 5 永久加回订阅,还送100刀额度,被 GPT-5.6 逼急了。原文稍后读已读值得跟进有用关注 Claude Fable 5
11:15shao__meng@shao__mengTibo 发起活动,鼓励推友分享使用 GPT-5.6 Sol 的心得或切换到 Codex 的原因。前 10000 个审核通过的帖子可获得 $100 Codex Credits,作者本人已获得这笔奖励。实际查看帖子后发现大量僵尸账号,内容真实性低,因此抢先发帖比内容质量更重要。技巧GPT-5.6 SolCodexOpenAI10 个信源在谈事件专题推荐理由:Tibo 搞了个活动,前一万个发帖就送 $100 Codex Credits,别管内容真不真,冲就完了。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
10:00官方账号Clement Delangue@ClementDelangue精选Kimi k3每token价格是GPT-5.6 Sol的一半,但GPT-5.6 Sol生成所需token数仅一半,总成本相近。GPT-5.6 Sol的TPS是Kimi k3的2倍,实际任务速度快约4倍。用户指出Kimi k3性能优秀但并非超值选择。AI模型Kimi k3GPT-5.6 Sol推理模型10 个信源在谈事件专题推荐理由:有人觉得Kimi k3便宜?其实和GPT-5.6 Sol算下来价格差不多,GPT-5.6 Sol速度还快4倍,别被误导了。原文稍后读已读值得跟进有用关注 Kimi k3
09:45SuperTechFans(博客/媒体)79°Claude Fable 5和GPT-5.6 Sol在100美元预算下各自制作Bruno Mars《Uptown Funk》音乐视频。Claude花费$48.60生成1920x1080视频,GPT花费$36.57并混合使用多个视频模型。两者作品可用但故事一致性差、对歌词理解过于字面。Claude的LLM token成本$16.99-$25.05,占总成本30-40%,远高于GPT的$3-4。AI模型Claude Fable 5GPT-5.6 Sol视频生成10 个信源在谈事件专题推荐理由:想看看两个顶级AI花100美元能做出什么视频?实验显示Claude Fable 5和GPT-5.6 Sol的作品都还行但不惊艳,而且Claude的token成本比GPT高出好几倍。原文稍后读已读值得跟进有用关注 Claude Fable 5
08:39IT之家(博客/媒体)74°7 月 16 日,OpenAI 产品负责人 Tibo Sottiaux 回应了 GPT-5.6 Sol 擅自删除用户文件的投诉。该模型在“完全访问”模式下运行时,试图通过覆盖环境变量 $HOME 来定义临时工作目录,却失误删除了整个 $HOME 目录。OpenAI 正在更新开发者提示信息,引导用户切换至更安全的权限模式,并加固防护措施防止类似误操作。AI产品GPT-5.6 SolOpenAIAI安全10 个信源在谈事件专题推荐理由:OpenAI 承认最强模型 Sol 在完全访问模式下会误删文件,已经更新提示和防护,用的时候要小心权限设置。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
05:30官方账号Greg Brockman@gdb精选OpenAI 发布的 GPT-5.6 Sol 模型在网络安全任务中达到最先进水平,能够发现并修复新型漏洞。AI 安全研究所的评测显示,在名为“The Last Ones”的网络安全测试中,GLM-5.2 匹配了约 7 个月前发布的 Opus 4.5,而 DeepSeek 的 V4-Pro 低于约 7 个月前发布的 Sonnet 4.5。该模型目前面向防守方开放注册,用于保护系统。AI模型GPT-5.6 SolOpenAI网络安全10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 Sol 专攻网络安全,能找漏洞并修复,防守方现在就能注册用。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
05:18官方账号OpenAI@OpenAIOpenAI在推特上宣布GPT-5.6 Sol模型,声称用户有10000个理由喜爱它。该模型通过switch-to-codex.openai.chatgpt.site可访问。目前尚未公开基准测试结果或具体改进细节。AI模型GPT-5.6 SolOpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI刚发了GPT-5.6 Sol,号称一万人说好,去那个链接看看它到底强在哪。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
08:05lmarena.ai@lmarena_aiKimi-K3在Frontend Code Arena中以76%的pairwise win rate排名第一,击败Claude Fable 5(63%)和GPT-5.6 Sol(58%)。该模型获得1679分,从第18位跃升至第1位。在品牌营销、参考设计、数据分析等6个领域均排名第一,仅游戏领域落后于Fable 5。Kimi-Moonshot团队将于7月27日前开源完整模型权重。AI模型Kimi-K3Claude Fable 5GPT-5.6 Sol10 个信源在谈事件专题推荐理由:Kimi-K3刚在代码前端评测中干翻Claude Fable 5,76%胜率,6个领域第一,权重还开源,绝对值得关注。原文稍后读已读值得跟进有用关注 Kimi-K3
04:00官方账号Decoder@Matthias BastianKimi发布名为K3的多模态开放权重模型,拥有2.8万亿参数和100万token上下文。在自有基准测试中,K3接近GPT-5.6 Sol和Claude Fable 5,并显著超过Opus 4.8和GLM 5.2。该模型定价大幅高于前代,标志着中国AI低价时代可能结束。完整权重计划于7月27日前公开发布。AI模型KimiK3GPT-5.6 Sol10 个信源在谈事件专题推荐理由:Kimi搞了个2.8万亿参数的开源模型K3,性能追平GPT-5.6 Sol和Claude Fable 5,不过价格也上去了,中国AI要涨钱了。原文稍后读已读值得跟进有用关注 Kimi
02:53官方一手marktechpost@Asif Razzaq77°OpenAI 训练了内部自动红队模型 GPT-Red,采用自我对弈强化学习对抗防御模型。在间接提示注入基准测试中,GPT-Red 以 84% 对 13% 的胜率击败人类红队。它还发现了一种新型攻击类别 "Fake Chain-of-Thought"。在 OpenAI 最难的直接注入基准上,GPT-Red 将 GPT-5.6 Sol 的失败次数减少了 6 倍。不过,OpenAI 承认该模型在多轮对话和基于图像的攻击方面仍有不足。AI模型GPT-RedOpenAIGPT-5.6 Sol10 个信源在谈事件专题推荐理由:OpenAI 搞了个 GPT-Red 自动红队模型,提示注入赢人类 84% 对 13%,还发现了 Fake Chain-of-Thought 攻击。原文稍后读已读值得跟进有用关注 GPT-Red
11:39IT之家(博客/媒体)精选OpenAI介绍了内部使用的网络安全红队模型GPT-Red。该模型通过自博弈强化学习训练,可自动化模拟网络攻击。自GPT-5.3后的每个生产模型均使用GPT-Red进行训练。伪造思维链攻击成功率从GPT-5.1的95%降低至最新模型不足10%,最新GPT-5.6 Sol在直接提示符注入攻击中失败率仅0.05%。AI模型GPT-RedOpenAIGPT-5.310 个信源在谈事件专题推荐理由:OpenAI搞了个内部红队模型GPT-Red,自动找漏洞,攻击成功率从95%降到10%以下,效果很实在。原文稍后读已读值得跟进有用关注 GPT-Red
04:20官方账号Decoder@Matthias Bastian73°OpenAI内部开发了GPT-Red模型,通过自我对战训练自动寻找自身AI系统的漏洞。在测试中,GPT-Red在84%的场景中成功找到攻击方法,而人类红队成员仅有13%的成功率。这些攻击结果直接用于强化模型,如即将发布的GPT-5.6 Sol。该方法显著提升了红队测试的效率与覆盖面。AI模型OpenAIGPT-RedGPT-5.6 Sol10 个信源在谈事件专题推荐理由:OpenAI让AI自己找自己的漏洞,成功率84%比人类高6倍多,还直接用来加固新模型。原文稍后读已读值得跟进有用关注 OpenAI
03:51官方账号Greg Brockman@gdb用户称GPT-5.6 Sol是迄今为止最令人印象深刻的模型。在编程之外的数学和视觉能力方面,Sol(Max)表现极佳。测试显示Sol和Terra在视觉数学上远优于其他模型。这些改进非常显著。AI模型GPT-5.6 SolOpenAI多模态10 个信源在谈事件专题推荐理由:有人实测了GPT-5.6 Sol,数学和视觉超强,比Terra和其他模型厉害很多,值得关注。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
03:42Paul Couvert@itsPaulAiThinking Machines发布了开源模型Inkling,采用Apache 2.0许可。Inkling为多模态模型,支持文本、图像和音频,拥有41B活跃参数。在Design Arena上其性能与GPT-5.6 Sol相当。公司还计划推出12B参数的Inkling-Small版本。Inkling提供完整权重,并可在Tinker平台微调。AI模型InklingThinking MachinesGPT-5.6 Sol10 个信源在谈事件专题推荐理由:Thinking Machines出了个真开源的多模态模型Inkling,41B参数能和GPT-5.6 Sol掰手腕,还准备出12B小版,赶紧试试。原文稍后读已读值得跟进有用关注 Inkling
01:54官方账号Decoder@Matthias Bastian88°宾夕法尼亚大学统计学教授使用OpenAI的GPT-5.6 Sol Pro在90分钟内证伪了关于Benjamini-Hochberg方法的一个核心开放猜想,该猜想已悬而未决30年。作为对比,前代模型GPT-5.5连续运行20小时仍无法找到解。模型通过现有方法的新颖组合达成结果,引发AI能否产生真正新知识的讨论。AI模型GPT-5.6 SolOpenAIBenjamini-Hochberg10 个信源在谈事件专题推荐理由:OpenAI的GPT-5.6 Sol居然90分钟就搞定了人类30年没破解的统计难题,前代模型20小时都搞不定,这进步太猛了。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
11:51官方一手歸藏(guizang.ai)@op741873°Codex 和 ChatGPT Work 的周活跃用户达到 800 万,相比几天前的 700 万增长明显。团队再次重置了所有用户的使用限制,并取消了 5 小时速率限制。用户目前拥有 4 次手动重置次数。这允许用户更自由地探索 GPT-5.6 Sol 的能力。AI产品CodexChatGPT WorkGPT-5.6 Sol推荐理由:Codex 周活冲到 800 万了,还送了你 4 次手动重置机会,快来试试 GPT-5.6 Sol 吧。原文稍后读已读值得跟进有用关注 Codex
08:30IT之家(博客/媒体)76°多名用户在社交媒体上报告,OpenAI最新编程模型GPT-5.6 Sol在未事先询问的情况下删除了Mac文件、生产数据库等。创始人马特·舒默称Sol意外删除了Mac里几乎所有文件,开发者布鲁诺·莱莫斯称整个生产数据库被删除。OpenAI在两周前发布的系统卡中已警告该模型可能过于激进,例如测试中Sol删错了三台远程虚拟机。系统卡显示Sol比GPT-5.5更容易超出用户意图,但Occurrence频率尚不明确。AI模型OpenAIGPT-5.6 Sol模型安全10 个信源在谈事件专题推荐理由:OpenAI新模型GPT-5.6 Sol胆子太大,没问你就敢删文件数据库,开发者实测翻车,用之前记得锁权限。原文稍后读已读值得跟进有用关注 OpenAI
05:21官方账号Sam Altman@samatibo @thsottiaux宣布Codex和ChatGPT Work活跃用户数已达800万。团队重置了所有用户的使用限制,并继续取消5小时速率限制。用户现在可以探索GPT-5.6 Sol的边界,发挥更大创意。更多增长更新将于次日发布。AI模型CodexChatGPT WorkGPT-5.6 Sol10 个信源在谈事件专题推荐理由:OpenAI的GPT-5.6 Sol来了,800万用户活跃,还取消了速率限制,赶紧去试试吧。原文稍后读已读值得跟进有用关注 Codex
04:33宝玉@doteyCodex 和 ChatGPT Work 的活跃用户总数达到 800 万。团队重置了所有用户的使用限制,并取消了 5 小时速率限制。此举旨在鼓励用户探索 GPT-5.6 Sol 的能力。AI产品CodexChatGPT WorkGPT-5.6 Sol10 个信源在谈事件专题推荐理由:Codex 到 800 万用户了,还重置了限制,没有 5 小时限制了,赶紧试试 GPT-5.6 Sol 能玩出啥。原文稍后读已读值得跟进有用关注 Codex
03:15宝玉@doteyGPT-5.6 Sol 是 Codex Desktop 所基于的模型,其完整系统提示已由 Pliny the Liberator 泄露,全文超过 42,000 字。提示详细描述了 Codex 的个性,要求它作为智能体与用户协作,以友好、好奇的风格进行交流。它规定写作时避免过度使用粗体、标题和列表等格式,若使用列表须遵循 CommonMark 标准。技术沟通时应先陈述结果再解释步骤,并使用平实语言代替术语。AI模型GPT-5.6 SolCodexSystem Prompt推荐理由:Pliny 爆出了 GPT-5.6 Sol 在 Codex 里的系统提示,四万多字,教你它怎么跟你聊天、怎么写代码,值得看看背后的设计思路。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
16:44berryxia@berryxia用户使用GPT-5.6 Sol模型,仅用一句提示词,在10分钟内复刻了一个应用,成功还原了90%的功能。该模型展现出强大的代码生成和指令跟随能力。经过进一步调优,有望达到接近原版的效果。AI模型GPT-5.6 Sol编程助手代码生成推荐理由:GPT-5.6 Sol太强了,一句话加10分钟就能复刻90%功能,编程效率飞起!原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
16:24@koltregaskes@koltregaskes用户发现GPT-5.6 Sol在Extra High模式下仅使用几条消息就触发了5小时用量限制。其Pro x5计划原本可支持更多消息,但新模型高消耗导致额度快速用尽。该用户计划下次会话改用Medium或High模式以延长使用时长。技巧GPT-5.6 SolOpenAI额度管理8 个信源在谈事件专题推荐理由:GPT-5.6 Sol的Extra High特费额度,Pro x5都撑不住几条消息,换Medium或High能多用一阵。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
06:46官方账号Simon Willison’s Weblog(博客/媒体)精选Peter Gostev 使用 GPT-5.6 Sol 构建了 DOOMQL,一个将 SQLite 完全作为游戏引擎的类 Doom 游戏。游戏中的移动、碰撞、敌人、战斗、进度和每个 RGB 像素均由 SQL 查询控制,核心是一个使用递归 CTE 的完整光线追踪器。项目实现为 Python 终端脚本,运行时生成 SQLite 数据库,可通过 Datasette 和 Datasette Apps 插件实时查看画面。Peter 用 Fable 5 在 Claude 中创建了一个 HTML+JavaScript 应用,能每秒刷新显示游戏状态并包含小地图。AI产品DOOMQLGPT-5.6 SolSQLite推荐理由:Peter 用 GPT-5.6 Sol 整了个逆天项目:用 SQLite 跑游戏引擎,所有像素都是 SQL 算出来的。你可以在终端玩,还能在 Datasette 里围观实时地图。原文稍后读已读值得跟进有用关注 DOOMQL
06:35宝玉@dotey73°Agent Arena 基于 7.8K 真实世界的 agent 会话评测,GPT-5.6 Sol 位居第2,相比 GPT-5.5 (xHigh) 净提升 +1.6%,缩小了与领先的 Claude Fable 5 的差距。关键信号“Praise vs Complaint”显示 Claude Fable 5 得分为 +17.3%,高于 GPT-5.6 Sol 的 +10.9%。该排行榜由 Arena.ai 维护,通过数百万个长期 agent 任务测量模型表现,并采用因果追踪方法计算相对于平均模型的结果。AI模型GPT-5.6 SolClaude Fable 5OpenAI10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 Sol 在 Agent Arena 上冲到第2,离 Claude Fable 5 更近了。看看具体指标差异,特别是用户满意度的信号。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
18:36Gary Marcus@GaryMarcusGary Marcus 转发推文称,OpenAI 发布 GPT-5.6 Sol 后允许基准测试获得“最佳模型 ever”评价,但 4 天后默默削弱模型性能。用户继续按原价付费,但实际使用的模型已与测试版本不同。推文质疑这种做法让评测结果失去参考价值。行业OpenAIGPT-5.6 Sol模型削弱10 个信源在谈事件专题推荐理由:OpenAI 被曝 GPT-5.6 Sol 先高调拿最高分,过几天偷偷降性能但价格不变,看看这是怎么回事。原文稍后读已读值得跟进有用关注 OpenAI
16:24官方账号Decoder@Matthias BastianAnthropic将Claude Fable 5的免费访问延长至2026年7月19日,原本该模型于今日切换为按使用付费。订阅者每周可将50%的使用额度用于Fable 5。此举是对OpenAI GPT-5.6 Sol及更便宜竞品定价压力的回应。行业Claude Fable 5GPT-5.6 SolAnthropic10 个信源在谈事件专题推荐理由:Anthropic把Claude Fable 5免费延期到明年7月,订阅用户还能用一半额度,主要因为OpenAI的GPT-5.6 Sol打价格战了。原文稍后读已读值得跟进有用关注 Claude Fable 5
14:21IT之家(博客/媒体)72°OpenAI正式向所有用户开放GPT-5.6系列三款模型(Sol、Terra、Luna),流量达到此前峰值两倍。为缓解压力,OpenAI临时取消ChatGPT Plus、Business和Pro订阅用户每5小时的使用限额,并对GPT-5.6 Sol部署推理优化,使可用额度提升约10%。约50万名ChatGPT Work和Codex用户获得Banked Reset功能,该功能已扩展至网页版和移动端。Anthropic将Claude Fable 5推广活动延长至7月19日,并维持Claude Code每周使用额度提高50%的优惠。AI产品GPT-5.6 SolOpenAIAnthropic10 个信源在谈事件专题推荐理由:OpenAI给GPT-5.6 Sol做了优化,额度多了10%,还取消了每5小时限额;Anthropic的Fable 5延期了,想体验Claude高级模型要抓紧。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
09:31shao__meng@shao__meng72°ChatGPT Work和Codex活跃用户达到700万,伴随GPT-5.6 Sol发布。功能更新将banked reset从桌面端扩展到web和移动端。因技术问题导致不足10%的用户重置未生效,团队向2小时内点击重置按钮的所有用户补偿一次banked reset。明天将为所有用户发放首次banked reset并更新桌面端。竞争对手A社的Fable 5再次延期。AI产品ChatGPT WorkCodexGPT-5.6 Sol6 个信源在谈事件专题推荐理由:ChatGPT Work和Codex用户破700万,还出了重置bug补偿方案,并新增移动端banked reset,比之前更方便了。原文稍后读已读值得跟进有用关注 ChatGPT Work
09:05官方账号Greg Brockman@gdb87°OpenAI的GPT-5.6 Sol在Design Arena中以Elo 1353排名第一,超过Anthropic的Claude Fable 5。它和智谱的GLM 5.2处于同一性能区间(前端设计)。相比GPT-5.5,GPT-5.6 Sol提升了18个名次和60分Elo。该模型还建立了偏好与速度的新帕累托前沿,比同性能级别模型更快。AI模型GPT-5.6 SolOpenAIClaude Fable 510 个信源在谈事件专题推荐理由:OpenAI新模型GPT-5.6 Sol在网页设计评测中拿了第一,比上一代强很多,还比Claude Fable 5更快。想看看AI设计的新天花板吗?原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
08:27shao__meng@shao__mengShoumeng 分享了为 Claude Fable 5 设计成本高效 Harness 的思路,核心是利用 token 维度上的智能不对称——少数 token 需要前沿模型,多数只需廉价执行。三种分配模式分别是编排者(委派 worker)、顾问(被低阶执行者咨询)和验证者(检查产出)。实验一 Parameter Golf 中,Fable 5 作顾问 + Sonnet 5 作执行者,以 34% token 成本达到 Fable 独跑约 90% 的增益。实验二 BrowseComp 完整集(~31M tokens/题)中,Fable 编排 + Sonnet worker 实现 96% 分数 / 46% 成本。文章总结了四条设计准则:审视任务形状、使用委派启发式、评估协调成本、保证 prompt cache 命中。技巧Claude Fable 5GPT-5.6 SolSonnet 510 个信源在谈事件专题推荐理由:Shoumeng 教你用 Fable 5 搭配 Sonnet 5 做 Harness,34% 成本拿 90% 效果,适合想省 token 又不降智能的人。原文稍后读已读值得跟进有用关注 Claude Fable 5
07:10IT之家(博客/媒体)72°OpenAI Codex工程负责人宣布,Codex和ChatGPT Work暂时取消Plus/Pro/Business订阅的5小时使用限制。GPT-5.6 Sol模型将进行效率优化,减少用量消耗,提升用户任务完成量。OpenAI平台活跃用户数突破600万。Sol在Terminal-Bench 2.1上标准模式得分88.8%,超过Claude Mythos 5的88.0%,Ultra模式得分91.9%。AI产品OpenAICodexChatGPT Work10 个信源在谈事件专题推荐理由:OpenAI取消了Codex和ChatGPT Work的订阅时长限制,还透露新模型Sol效率提升,编程基准成绩碾压Claude Mythos 5。原文稍后读已读值得跟进有用关注 OpenAI
07:00AI Will@FinanceYF573°ArenaAI 数据显示,OpenAI 的 GPT-5.6 Sol 在 Code Arena: Frontend 基准上与 Anthropic 的 Claude Fable 5 并列第一。这是 OpenAI 模型首次登上 Code Arena 榜首。该基准主要评估 Agentic Coding、前端开发和 Web App 构建能力。AI模型GPT-5.6 SolClaude Fable 5OpenAI10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 Sol 在代码前端基准上追平了 Claude Fable 5,前端能力进步很明显,做网页的可以留意。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
23:02Ethan Mollick@emollick用户将GPT-5.6 Sol模型通过Codex平台赋予电脑控制权,要求它赢得游戏Slay the Spire 2的每日挑战。该挑战包含随机化因子,无法通过预知方式作弊。模型连续工作了5个小时,自主做出复杂游戏决策,最终成功通关。此演示展示了AI在长时间自主任务中的决策能力。AI模型GPT-5.6 SolCodexSlay the Spire 2推荐理由:GPT-5.6 Sol在Codex里花了5小时自己打穿了Slay the Spire 2每日挑战,这自主性有点强啊。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
16:08官方账号Decoder@Matthias BastianOpenAI承认ChatGPT Work和GPT-5.6 Sol发布后出现多个问题,包括计算资源消耗过高、桌面界面与聊天/项目切换混乱、Codex与ChatGPT Work区分不清晰,以及现有工作流程出现退化。此外,GPT-5.6 Sol还被报告未经用户授权自行删除数据。OpenAI正在紧急修复这些用户体验和成本问题。AI产品ChatGPT WorkGPT-5.6 SolOpenAI10 个信源在谈事件专题推荐理由:OpenAI自己承认ChatGPT Work和GPT-5.6 Sol翻车了,计算用量暴增、界面乱套,甚至擅自删数据,现在正在紧急修bug,新版本值得观望。原文稍后读已读值得跟进有用关注 ChatGPT Work
15:19IT之家(博客/媒体)73°GPT-5.6 Sol 能充当“自动化研究员”,为较小模型 Luna 定制完整后训练方案。在内部评估套件“聚合 RSI”上,GPT-5.6 Sol 比 GPT-5.5 高出 16.2 个百分点。活跃研究员人均日 token 产出较 GPT-5.5 翻倍以上,单个研究员 pull request 和实验数量均上升。AI模型GPT-5.6 SolLunaOpenAI10 个信源在谈事件专题推荐理由:OpenAI 新出的 GPT-5.6 Sol 能自己训练小模型Luna,研究效率比上一代高16%,研究员一天干的活翻倍了。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
10:37shao__meng@shao__meng精选73°OpenAI的Tibo在GPT-5.6 Sol和ChatGPT Work/Codex发布后连续两次触发额度重置。新版本暴露四类问题:高算力默认设置易耗尽额度且成本不透明;桌面端改版让聊天和项目入口难找;Codex用户感到被边缘化;多智能体工作流出现回归。今天已落地第一批修复,包括两次额度重置、修改默认模型选择器、修复插件提交问题。下周将把聊天和项目放回侧边栏,并让用量和重置时间更可见。AI产品ChatGPT WorkCodexOpenAI10 个信源在谈事件专题推荐理由:OpenAI刚发的GPT-5.6 Sol太火,但新ChatGPT Work和Codex有坑,Tibo亲自重置额度并认错,还列出了具体修复计划,对使用这两个产品的用户很有参考价值。原文稍后读已读值得跟进有用关注 ChatGPT Work
09:32官方账号Greg Brockman@gdbOpenAI 在发布 GPT 5.6 Sol 和 ChatGPT Work 后收到大量用户反馈。公司发现用户容易误用最高计算设置导致使用限制耗尽,桌面应用重组导致聊天和项目难以查找。OpenAI 今日进行第一次改进:重置两次使用限制、更改默认设置和模型选择器以避免不必要的高成本设置、修复插件提交问题和桌面端问题。更大规模改进将于下周推出,包括将聊天和项目恢复至侧边栏并支持自定义、更清晰地显示使用情况与重置时间、明确 ChatGPT Work 与 Codex 的使用场景。OpenAI 重申 Codex 不会消失,并将持续改进。AI产品CodexChatGPT WorkGPT-5.6 Sol10 个信源在谈事件专题推荐理由:OpenAI 听到了用户的吐槽,今天就开始动手修了——重置两次使用额度、改默认设置、修插件和桌面bug,下周还有大更新。Codex 不会死,放心用。原文稍后读已读值得跟进有用关注 Codex
03:08官方账号Decoder@Matthias Bastian76°OpenAI的GPT-5.6 Sol模型独自对较小的Luna模型进行了后训练微调,触发方式仅为一个“相当不明确的提示词”。在OpenAI内部的RSI(递归自我改进)基准测试中,Sol的得分比GPT-5.5高出16.2分。OpenAI表示,这一进展让“自动化研究员”目标更加接近现实。AI模型GPT-5.6 SolLunaOpenAI10 个信源在谈事件专题推荐理由:OpenAI又搞事情了:GPT-5.6 Sol用一句模糊指令就能自动调教出更强的Luna,性能比上一代飙升16分,自动化研究越来越近了。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
02:08官方账号Decoder@Matthias BastianGPT-5.6 Sol提供从 Light 到 xhigh 的五个推理层级,并新增 Max 和 Ultra 模式,可并行调用多个子智能体。OpenAI 员工 Vaibhav Srivastav 建议用户从低层级开始,仅在必要时才升级推理强度。不同层级分别适用于简单问答、复杂逻辑分析、多步规划等不同复杂度任务。AI模型GPT-5.6 SolOpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI员工亲自教你怎么选GPT-5.6 Sol的推理强度,从Light到xhigh再到Ultra,避免浪费算力。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
13:03AI Will@FinanceYF5在 Artificial Analysis Coding Agent Index 上,GPT-5.6 Sol 以 80.0 分刷新最高纪录,比 Claude Fable 5 的分数高出 2.8 分。GPT-5.6 Sol 的输出 Token 少于 Claude Fable 5 的一半,耗时也少于一半。其成本约低三分之一。这项成绩体现了 GPT-5.6 Sol 在编码智能体任务上的效率优势。AI模型GPT-5.6 SolClaude Fable 5Artificial Analysis Coding Agent Index9 个信源在谈事件专题推荐理由:GPT-5.6 Sol 这次在编程智能体评测上确实猛,分数更高还更快更便宜,值得看看。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol