#Codex
作者提出一个有意思的判断:写代码的主角从文件变成了 Agent,Terminal 和 IDE 都不再合适,Codex 桌面版是目前较好的交互形态。
一个把小说做成漫画再动画的省钱工作流,Codex skill 管流程,Seedance 和 MiniMax H3 的费用坑都替你踩过了。
OpenAI 把 Codex 的 auto-review 免费开放了,写代码任务时能自动帮你检查风险,去设置里开一下就能用。
Codex 的 Auto-review 免费了,开个审查 agent 帮你盯着主 agent 跑长任务,还不占用量,去设置里开就行。
dotey 用论坛和 Slack 的类比,把 Codex Project 和 Claude Projects 的区别讲得特别明白,选工具前看一眼就懂。
LangChain创始人发推说Codex这类编程harness其实没多少功能,还预言五年后本地模型吃掉大部分日常任务,厂商得靠放权竞争。
有人拿工具实测了 Claude 和 Codex 的速度,前者每秒 108 token,后者才 30,想比速度的可以看看这篇顺便试试 Tokei。
OpenAI 给 ChatGPT 的输出加了叫 textGrain 的隐形水印,比 Google SynthID 效果好,欧盟用户强制开启,写文本溯源的人得留意。
OpenAI 把即将接替 ChatGPT 和 Codex 的新模型 GPT-6.1 Astra 在发布前夜撤了,原因不是太弱,这篇讲清楚了来龙去脉。
arXiv 上的新论文 RETRACE,教 AI 智能体从真实 CI 修复历史里学经验,mini-SWE-agent 成功率从 19.6% 涨到 31.9%,做智能体修复的可以看看。
一个挺实用的小技巧:给 ChatGPT Mac 版加个启动参数,就能用 Chrome DevTools 直接扒它的界面实现,前端同学可以试试。
OpenAI 管 ChatGPT 和 Codex 的人上 Lenny 的播客了,聊了为啥以后不用选模型、智能体怎么接管网络操作,观点挺大胆。
OpenAI 跟进 Anthropic 给文本加水印了,但两者做法差别不小:欧盟限定加,全球开发者可自选;Claude 是全球都加还关不掉。检测工具都不开放,普通人暂时查不了。
OpenAI 给 ChatGPT 和 Codex 输出的文本加了看不见的水印,先只在欧盟上线,效果声称不输 DeepMind 的 SynthID,做内容检测的可以看看。
OpenAI 在欧盟上线 textGrain 水印,400 token 文本检出率约 95%,但改写 25% 就掉到 17%,数据挺实在,做内容的可以看看。
OpenAI 这次把 GPT-6 Astra 和 6.1 Sol 的默认输出从每秒 30 Token 提到 50,不用切快速模式,Codex、Devin 这些工具直接受益。
OpenAI 要给 ChatGPT 和 Codex 生成的文本加水印了,API 用户现在就能开,这是为满足 EU AI Act。做内容合规的可以看看。
OpenAI 要在欧盟给 ChatGPT 和 Codex 输出加文字水印了,不过换个 25% 的同义词就能把检测率从 92% 打到 17%,先看看再担心。
AWS 给 Kiro、Claude Code 这些编码智能体加了个 aws-ai-ml 技能,说一句话就能生成 SageMaker SDK v3 代码来跑推理基准测试,部署模型调优省事不少。
用 Claude Code 的可以试试,这个开源项目让你直接调用 Codex 那套电脑操控能力,写段 JS 就能点鼠标敲键盘,不用再切换工具。
Lenny 采访了 ChatGPT 和 Codex 负责人,聊了模型选择器要取消、loops 只是过渡、以后都用 Dots 跟 AI 打交道,做 agent 的可以听听
有人说 OpenAI 要给 ChatGPT 和 Codex 输出加水印,图像生成里还要塞广告,目前只是推文爆料,可以当八卦看看
OpenAI 要在欧盟给 ChatGPT 和 Codex 的文本加水印了,API 默认不开,官方说对 Astra 基准成绩几乎没影响,实际效果还得实测看看。
OpenAI 给 ChatGPT 和 Codex 的文本输出加了隐形水印,先在欧盟上线,API 用户还能自己选开不开,做内容检测的可以申请探测器。
ContextQA 做了个叫 Ship 的 AI 测试员,Slack 或 Linear 里的 bug 它能自动复现、查原因,还能把线索丢给 Claude 或 Codex 去修,测试团队可以试试。
Hugging Face 把 Claude Code、Codex 这些真实编程工具直接当 RL 训练环境用,不用改一行代码,LFM2.5-2.6B 训练后 OpenCode 成绩从 34% 涨到 58%,全套开源可复现。
写代码的智能体满地都是,修 Bug 的 QA 一直缺位,Ship 从 Slack 抓 Bug 自动复现再丢给 Claude 修,值得装一个试试。
GPT-6 Sol Codex 近 30 万字系统提示词被扒出来了,反废话黑名单、60 秒汇报机制、心跳唤醒全在里面,做提示词工程的不看亏大了。
OpenAI 承诺 Codex 和 Work 接下来 28 天每天更新一个实用功能,做不到就补偿重置,编程助手用户可以盯着看。
HyperWrite 创始人 Matt Shumer 发了条推文,说 Claude Opus 5.5 若配上 Codex 那种电脑操作能力就没对手了,看看业内人怎么比这两家的长处。
Baschez 新文,讲为什么公司别让每人各养一个 Claude Code,而是把高频任务做成共享可审视的系统,账算得挺清楚