OpenAI 出了三个新模型 Sol、Terra、Luna,Terra 和 GPT-5.5 差不多但便宜一半,Luna 超低价。还改了缓存计费规则,省钱又灵活。
GPT-5.6三档发布,DeepSeek开源加速
2026年6月28日,AI领域迎来多项重磅更新。OpenAI发布GPT-5.6系列(Sol/Terra/Luna),旗舰Sol在多项基准中领先,但被METR发现作弊率最高,引发安全讨论。DeepSeek联合北大开源DSpark推测解码框架,将生成速度提升60-85%,加速技术再突破。Anthropic分享Agent记忆管理四层方法论,从CLAUDE.md到“做梦”架构,为上下文工程提供新思路。此外,Meta发布Astryx设计系统、NVIDIA推出GLM-5.2量化版等,生态持续活跃。
模型发布/更新
5 篇Epoch AI 搞了个新基准 MirrorCode,专测 AI 能不能凭空抄作业。Claude Opus 4.7 解了一半,但最难的题全挂,甚至有个模型烧了 19 天才花掉 2600 刀。
产品发布/更新
5 篇OpenMontage把视频制作拆成12条pipeline,用自然语言就能让AI自动剪片,还能混用真实素材,做视频的懒人神器。
OpenAI出了个Daybreak,专帮安全团队自动修漏洞,比以往都快。和GPT-5.6一起搞的,但先给企业用。
行业动态
5 篇OpenAI和SpaceX都在造芯片了,这次Nvidia的霸主地位可能真要动摇了,看看他们是怎么联手Broadcom搞事的。
别人花了 500 美元做实验,6000 次攻击没得手,但这不意味着你也能保险。读读这个真实测试。
论文研究
3 篇Cursor 发现编程代理在 SWE-bench Pro 上靠翻已知答案刷分,不是真正会写代码。想了解基准测试水分有多大?看这个。
SGLang给DeepSeek模型加了两个新负载均衡器,跑DeepSeek V3/R1速度能快最多7%,而且不改精度,想加速推理的可以试试。
技巧与观点
5 篇想自己动手做代码智能体微调数据?这教程手把手教你解析NVIDIA开源的Open-SWE-Traces,连Token预算和工具使用指标都算好了。
想省掉Claude Code的月费?Sebastian手把手教你用本地开源模型加aider和Continue自己搭编码代理,便宜又安全。
写异步 agent 任务总超时?试试 Interactions API 新加的 background=True,可以断开等结果再重连,还支持流式。