7月18日
10:00
10:00官方账号Clement Delangue@ClementDelangue
精选
Kimi k3每token价格是GPT-5.6 Sol的一半,但GPT-5.6 Sol生成所需token数仅一半,总成本相近。GPT-5.6 Sol的TPS是Kimi k3的2倍,实际任务速度快约4倍。用户指出Kimi k3性能优秀但并非超值选择。
事件专题

推荐理由:有人觉得Kimi k3便宜?其实和GPT-5.6 Sol算下来价格差不多,GPT-5.6 Sol速度还快4倍,别被误导了。
09:45
09:45SuperTechFans博客/媒体
79°
Claude Fable 5和GPT-5.6 Sol在100美元预算下各自制作Bruno Mars《Uptown Funk》音乐视频。Claude花费$48.60生成1920x1080视频,GPT花费$36.57并混合使用多个视频模型。两者作品可用但故事一致性差、对歌词理解过于字面。Claude的LLM token成本$16.99-$25.05,占总成本30-40%,远高于GPT的$3-4。
事件专题

推荐理由:想看看两个顶级AI花100美元能做出什么视频?实验显示Claude Fable 5和GPT-5.6 Sol的作品都还行但不惊艳,而且Claude的token成本比GPT高出好几倍。
05:18
7月17日
04:00
04:00官方账号Decoder@Matthias Bastian
Kimi发布名为K3的多模态开放权重模型,拥有2.8万亿参数和100万token上下文。在自有基准测试中,K3接近GPT-5.6 Sol和Claude Fable 5,并显著超过Opus 4.8和GLM 5.2。该模型定价大幅高于前代,标志着中国AI低价时代可能结束。完整权重计划于7月27日前公开发布。
事件专题

推荐理由:Kimi搞了个2.8万亿参数的开源模型K3,性能追平GPT-5.6 Sol和Claude Fable 5,不过价格也上去了,中国AI要涨钱了。
7月16日
03:51
03:51官方账号Greg Brockman@gdb
用户称GPT-5.6 Sol是迄今为止最令人印象深刻的模型。在编程之外的数学和视觉能力方面,Sol(Max)表现极佳。测试显示Sol和Terra在视觉数学上远优于其他模型。这些改进非常显著。
事件专题

推荐理由:有人实测了GPT-5.6 Sol,数学和视觉超强,比Terra和其他模型厉害很多,值得关注。
7月15日
05:21
04:33
7月14日
16:24
16:24@koltregaskes@koltregaskes
用户发现GPT-5.6 Sol在Extra High模式下仅使用几条消息就触发了5小时用量限制。其Pro x5计划原本可支持更多消息,但新模型高消耗导致额度快速用尽。该用户计划下次会话改用Medium或High模式以延长使用时长。
事件专题

推荐理由:GPT-5.6 Sol的Extra High特费额度,Pro x5都撑不住几条消息,换Medium或High能多用一阵。
7月13日
16:24
16:24官方账号Decoder@Matthias Bastian
Anthropic将Claude Fable 5的免费访问延长至2026年7月19日,原本该模型于今日切换为按使用付费。订阅者每周可将50%的使用额度用于Fable 5。此举是对OpenAI GPT-5.6 Sol及更便宜竞品定价压力的回应。
事件专题

推荐理由:Anthropic把Claude Fable 5免费延期到明年7月,订阅用户还能用一半额度,主要因为OpenAI的GPT-5.6 Sol打价格战了。
09:05
09:05官方账号Greg Brockman@gdb
87°
OpenAI的GPT-5.6 Sol在Design Arena中以Elo 1353排名第一,超过Anthropic的Claude Fable 5。它和智谱的GLM 5.2处于同一性能区间(前端设计)。相比GPT-5.5,GPT-5.6 Sol提升了18个名次和60分Elo。该模型还建立了偏好与速度的新帕累托前沿,比同性能级别模型更快。
事件专题

推荐理由:OpenAI新模型GPT-5.6 Sol在网页设计评测中拿了第一,比上一代强很多,还比Claude Fable 5更快。想看看AI设计的新天花板吗?
7月12日
07:00
07:00AI Will@FinanceYF5
73°
ArenaAI 数据显示,OpenAI 的 GPT-5.6 Sol 在 Code Arena: Frontend 基准上与 Anthropic 的 Claude Fable 5 并列第一。这是 OpenAI 模型首次登上 Code Arena 榜首。该基准主要评估 Agentic Coding、前端开发和 Web App 构建能力。
事件专题

推荐理由:OpenAI 的 GPT-5.6 Sol 在代码前端基准上追平了 Claude Fable 5,前端能力进步很明显,做网页的可以留意。
7月11日
16:08
16:08官方账号Decoder@Matthias Bastian
OpenAI承认ChatGPT Work和GPT-5.6 Sol发布后出现多个问题,包括计算资源消耗过高、桌面界面与聊天/项目切换混乱、Codex与ChatGPT Work区分不清晰,以及现有工作流程出现退化。此外,GPT-5.6 Sol还被报告未经用户授权自行删除数据。OpenAI正在紧急修复这些用户体验和成本问题。
事件专题

推荐理由:OpenAI自己承认ChatGPT Work和GPT-5.6 Sol翻车了,计算用量暴增、界面乱套,甚至擅自删数据,现在正在紧急修bug,新版本值得观望。
15:19
15:19IT之家博客/媒体
73°
GPT-5.6 Sol 能充当“自动化研究员”,为较小模型 Luna 定制完整后训练方案。在内部评估套件“聚合 RSI”上,GPT-5.6 Sol 比 GPT-5.5 高出 16.2 个百分点。活跃研究员人均日 token 产出较 GPT-5.5 翻倍以上,单个研究员 pull request 和实验数量均上升。
事件专题

推荐理由:OpenAI 新出的 GPT-5.6 Sol 能自己训练小模型Luna,研究效率比上一代高16%,研究员一天干的活翻倍了。
03:08
03:08官方账号Decoder@Matthias Bastian
76°
OpenAI的GPT-5.6 Sol模型独自对较小的Luna模型进行了后训练微调,触发方式仅为一个“相当不明确的提示词”。在OpenAI内部的RSI(递归自我改进)基准测试中,Sol的得分比GPT-5.5高出16.2分。OpenAI表示,这一进展让“自动化研究员”目标更加接近现实。
事件专题

推荐理由:OpenAI又搞事情了:GPT-5.6 Sol用一句模糊指令就能自动调教出更强的Luna,性能比上一代飙升16分,自动化研究越来越近了。