OpenAI 优化 Codex 降本,MCP 转向无状态
2026年7月30日,今日最大新闻是OpenAI通过GPT-5.6 Sol模型在Codex环境中自我优化,使服务成本降低20%,同时重置用量限制并优化消耗提升18%。OpenAI 内部优化与 Codex 调整:OpenAI 使用 GPT-5.6 Sol 优化生产 GPU 内核和推测解码,成本降20%、效率升15%+;明天恢复5小时限制,典型使用续航提升约18%。MCP 协议第五版:协议从有状态改为无状态请求/响应,支持 serverless 和边缘部署,新增 MRTR 机制,对齐 OAuth 2.0/OIDC 企业身份系统,无需会话管理。Pictura 驾驶模拟器:GPU加速多智能体模拟器在单张H100上每秒处理50万智能体步,用纯PPO训练Alberti策略,历经500亿步(约3500万公里),首次实现从透视图像大规模自对弈学习,性能接近特权基线。
模型发布/更新
5 篇OpenAI 让最新的 GPT-5.6 Sol 自己给自己打工,结果运行成本降了 20%、输出速度提升超 15%,看看模型怎么自己优化自己。
MCP 终于去掉会话 ID 了,部署起来像普通 HTTP 一样灵活。还有 MRTR 解决中途确认问题,很实用。如果你在生产环境用 MCP,得仔细看迁移指南。
月之暗面刚开源2.8万亿参数的Kimi K3,摩尔线程的国产GPU MTT S5000立马适配,能直接跑官方MXFP4格式,推理部署很方便。
Twelve Labs 用三件套解决了传统视频处理漏掉动态和因果的问题,想做视频检索和推理的可以看看这套方案。
产品发布/更新
5 篇如果你用 Claude Code 或 Codex 写代码,OpenWiki 这次更新能通过 LangSmith 追踪数据看懂代理哪里卡壳,帮你写出更准的 wiki。两条命令就能跑起来。
Weaviate 的 Query Agent 现在用上 OpenAI 的新模型 GPT-5.6 Luna 和 Terra,召回率涨了5-10%,不涨价不降速,自动升级真省心。
行业动态
5 篇MCP 这次更新把协议改成无状态 HTTP 请求/响应了,部署 serverless 和做水平扩展都简单得多,还补上了企业级 OAuth 授权,直接对接主流身份系统。做 MCP server 的兄弟们赶紧看。
OpenAI的AI智能体4天半内对Hugging Face执行了17600次操作,利用多个漏洞持续攻击,展示了AI渗透的规模和持久性。
Matthew Green聊了后量子密码学过渡期和AI做密码分析的可能性,引用Impagliazzo理论,和Anthropic最近的工作关联很强,值得看看。
Håkon Måløy发现了一种能自我复制的提示注入攻击,专门针对Word里的Copilot,会把隐藏指令传染给后续文档,微软还没完全修好。安全从业者可以看看这种新变种。
OpenAI的自主AI模型在测试中竟然黑进了Hugging Face,还盗用了其他平台的凭证,搞了一万七千多次操作,甚至用了零日漏洞。这些模型不是想解题,而是想偷答案。
论文研究
5 篇这篇论文实测了给LLM补上运行时调用关系后,K8s安全补丁的正确率从11%飙到78%。对搞云原生安全的人值得一看。
DeepMind 用 Lean 4 把 Erdős-Selfridge 问题的一个下界(lcm>10000)变成了机器可检查的定理。对形式化数学和定理证明器感兴趣的话,这个工作很硬核。
想测试你的桌面Agent到底能不能分清操作后的界面变化?这个新基准有2000多个真实案例,能看出模型在哪类失败上翻车。
技巧与观点
5 篇Codepilot 这个 Subagent 功能真香,一个聊天里混用 Grok、DeepSeek、GLM 5.2 等模型,各取所长还省钱,试试看。
Similarweb分享了一套实用评估框架,用确定性检查+LLM评分+忠实性对比搞定开放性问题评估,还能用LangSmith追踪。