8月1日
19:48
19:48官方一手@OpenAIDevs@OpenAIDevs
81°
OpenAI在API中为GPT-5.6 Sol新增快速模式,处理速度最高为标准模式的2.5倍,价格为标准价格的2倍。该模式的智能水平与标准模式一致,不因加速而降低质量。现有请求若已标记priority标签,无需修改即可继续使用快速模式。
事件专题

推荐理由:OpenAI给GPT-5.6 Sol加了快速模式,加价2倍就能提速2.5倍,智商不变。老用户带priority标签的请求直接能用。
7月31日
13:53
13:53官方账号Greg Brockman@gdb
76°
GPT-5.6 Sol 找到了 Maxwell 猜想的反例,证实该猜想错误。这一猜想已存在超过 100 年,反例由 AI 发现后经人类数学家确认,论文已上传至 arXiv(编号 2607.27197)。成果展示了 GPT-5.6 Sol 在数学推理上的具体能力。
推荐理由:GPT-5.6 Sol 直接给 Maxwell 猜想找出了反例,人类数学家还验证了,这推理能力真有点吓人。
07:50
07:50官方账号OpenAI@OpenAI
精选
OpenAI 宣布降低 GPT-5.6 Luna 和 Terra 的 API 价格。同时为 GPT-5.6 Sol 推出 Fast 模式,速度可达标准处理的 2.5 倍,价格为标准价格的 2 倍。该模式不改变模型智能水平,专为需要更快响应的 API 客户设计。
事件专题

推荐理由:OpenAI 给 GPT-5.6 系列调价了:Luna/Terra 更便宜,Sol 多了个快模式,速度翻倍但价格只翻一倍,适合赶时间的高负载任务。
06:44
06:44官方账号OpenAI@OpenAI (@OpenAI)
ARC-AGI-3基准测试要求模型无需指令学习不熟悉的2D游戏。标准测试丢弃了GPT-5.6 Sol每步后的推理,并在上下文填满时丢弃早期动作。这导致模型无法积累有效经验,只能不断重启。测试结果凸显了长上下文维持对推理模型的关键性。
事件专题

推荐理由:ARC-AGI这个测试挺刁钻,GPT-5.6 Sol在没法记住之前推理的情况下学不会新游戏,说明长上下文对推理很重要。
06:12
06:12lmarena.ai@lmarena_ai
82°
OpenAI宣布GPT-5.6 Luna降价80%,现价$0.20/$1.20,推理能力增强但成本保持高效。GPT-5.6 Terra降价20%,现价$2/$12,提供前沿级智能。同时推出GPT-5.6 Sol更快API选项。降价后使用Codex和ChatGPT Work时,用量计算也相应减少。
事件专题

推荐理由:OpenAI给GPT-5.6真降价了!Luna便宜了八成,Terra也降了两成,搞推理成本大幅下降,赶紧看看新定价。
06:08
06:08Gary Marcus@GaryMarcus
82°
OpenAI宣布GPT-5.6 Luna降价80%,GPT-5.6 Terra降价20%。同时推出更快的GPT-5.6 Sol选项。降价后Codex和ChatGPT Work的用量计数也相应调整。此次调价旨在推动模型在成本效率、能力和速度方面的进步。
事件专题

推荐理由:OpenAI给GPT-5.6 Luna打了八折中的八折,API调用成本大降,赶紧去改配置。
03:33
03:33官方账号Sam Altman@sama
OpenAI 在部署后应用 GPT-5.6 Sol 进行效率自优化,让模型自身改进运行效率。结果显示,通过生产 GPU 内核优化,服务成本降低 20%。此外,改进的投机解码使 token 生成效率提升 15% 以上。这一成果展示了模型自我优化的实际收益。
事件专题

推荐理由:OpenAI 的 GPT-5.6 Sol 通过自学习优化运行,服务成本降了 20%,生成速度提了 15%,比手动调优更省心省钱。
01:40
01:40官方账号OpenAI@OpenAI (@OpenAI)
81°
OpenAI 通过 GPT-5.6 Sol 实现自身运行效率提升,使服务成本降低 20%。改进推测解码后,令牌生成效率提升 15% 以上。这些优化已转化为 Luna 和 Terra 模型的 API 价格下调。OpenAI 旨在让先进智能更普及。
事件专题

推荐理由:OpenAI 又升级了,GPT-5.6 Sol 让运行成本降了20%,速度快了15%,Luna 和 Terra 也降价了,开发者快看。
01:38
01:38官方账号OpenAI@OpenAI (@OpenAI)
OpenAI宣布GPT-5.6系列模型降价。GPT-5.6 Luna价格降低80%,GPT-5.6 Terra价格降低20%。API新增GPT-5.6 Sol快速选项。在Codex和ChatGPT Work中,Luna和Terra的使用量计算方式也随之调整,用户能以更低成本使用更多计算资源。
事件专题

推荐理由:OpenAI给GPT-5.6 Luna降了80%,Terra降了20%,还新加了Sol的快速版。API用起来更便宜更快了,想省钱就关注这个。
7月30日
17:57
17:57官方账号OpenAI@OpenAI
72°
OpenAI 通过 Responses API 实现了一项测试,启用了 Retained reasoning 和 Context compaction 功能。在公开数据集上,GPT-5.6 Sol 的得分提升了 188%,同时输出 token 数量减少了 6 倍。这一改进显著提高了模型的推理效率和输出质量。
事件专题

推荐理由:OpenAI 用 Responses API 让 GPT-5.6 Sol 分数涨了 188%,输出 token 还少了 6 倍,效率提升很明显。
08:38
08:38官方账号OpenAI@OpenAI
GPT-5.6 Sol 成功解决了数学中的开放问题,但在 ARC-AGI-3 2D 拼图基准测试中表现挣扎。调查发现,问题出在 API 的 harness 不允许模型记住之前学到的内容。启用两个 API 设置后,分数提高了 3 倍,同时输出 token 减少了 6 倍。
事件专题

推荐理由:OpenAI 发现 GPT-5.6 Sol 在 ARC-AGI-3 上表现差是因为 API 设置没开对。改两个参数分数涨三倍,token 省六倍,学起来很实用。
07:18
07:18官方一手@OpenAIDevs@OpenAIDevs
78°
OpenAI 使用 GPT-5.6 Sol 模型在 Codex 环境中对自身基础设施进行优化,改进在推理和智能体循环中产生更多有用工作。生产 GPU 内核优化使服务成本降低 20%,改进的推测解码使 token 生成效率提升 15% 以上。这些改进通过复用在相同硬件上获得更大的性能提升。
事件专题

推荐理由:OpenAI 让最新的 GPT-5.6 Sol 自己给自己打工,结果运行成本降了 20%、输出速度提升超 15%,看看模型怎么自己优化自己。
06:26
06:26官方账号Greg Brockman@gdb
78°
OpenAI 发布了 GPT-5.6 Sol,专门用于提升生产环境的服务效率。部署后,该模型通过自我优化机制进一步降低运行成本。具体改进包括:GPU 内核优化使服务成本降低 20%;推测解码算法改进使 token 生成效率提升超过 15%。
事件专题

推荐理由:OpenAI 搞了个新模型 GPT-5.6 Sol,能自己优化自己,部署后服务成本直接降了20%,生成速度还快了15%,搞推理服务的值得关注。
05:32
05:32官方账号OpenAI@OpenAI
OpenAI 部署 GPT-5.6 Sol 后,通过模型自我改进实现了效率提升。生产 GPU 内核优化使服务成本降低 20%。改进的推测解码算法使 token 生成效率提升 15% 以上。这些成果来源于模型自身运行效率的优化。
事件专题

推荐理由:OpenAI 让 GPT-5.6 Sol 自己优化自己,运行成本降了20%,生成速度也快了15%,挺牛的。
7月25日
02:55
02:55官方账号Decoder@Matthias Bastian
74°
Anthropic推出了旗舰模型Claude Opus 5,在编码和知识工作基准上取得高分。该模型在ARC-AGI-3(评估新颖问题解决能力的基准)上达到30.2%,几乎是GPT-5.6 Sol的四倍。其token价格仅为Fable 5的一半。
事件专题

推荐理由:Anthropic的新模型Opus 5在推理和编程上很强,价格只有Fable 5一半,性价比高。
7月22日
17:39
17:39官方账号Epoch AI@EpochAIResearch
EpochAI Research 宣布新项目 EpochAIPlays,其最新模型 GPT-5.6 Sol 将直播玩卡牌游戏《Slay the Spire》。直播将于周四启动,由 @AlephNuul 提供实时解说。该项目旨在公开演示 AI 在复杂策略游戏中的决策能力。

推荐理由:EpochAI 让 GPT-5.6 Sol 直播打《Slay the Spire》,周四有解说,看看 AI 怎么玩策略游戏,挺新鲜的。
7月19日
17:51
17:51官方账号Decoder@Matthias Bastian
精选
Moonshot的Kimi K3在Code Arena: Frontend排行榜上超越Claude Fable 5和GPT-5.6 Sol,成为首个登顶该榜单的中国模型。但在FrontierMath Tier 4数学测试中,Kimi K3仅得约39%,而OpenAI和Anthropic模型得分接近90%。差距主要体现在复杂数学推理能力上。
事件专题

推荐理由:国产模型Kimi K3前端代码很强,能超过Fable 5,但数学推理还差得远。想了解具体差距多大,可以看看这篇。
7月18日
15:45
15:45官方账号Decoder@Matthias Bastian
Anthropic将于7月20日起在Max和Team Premium计划中纳入Claude Fable 5,但仅提供常规限额的50%,而常规限额同日将削减三分之一。Pro用户将获得一次性100美元信用额度,此后按API费率支付。这一逆转源于OpenAI更便宜的GPT-5.6 Sol带来的竞争压力。
事件专题

推荐理由:Anthropic调整Fable 5订阅:Max和Team配额减半,Pro用户一次性补贴后走API,应对OpenAI的GPT-5.6 Sol低价冲击。