全部动态
OpenAI 的 GPT-5.6 Sol 模型在 Q3 成为企业增长的关键,开发者们纷纷选择它,而 Fable 5 则因价格和数据保留要求受限。
Ben Davis 在 x.com 上展示了 DeepSWE 在多项任务中的出色表现,比 Fable 和 GPT-5.6-sol 更胜一筹,值得关注。
Gary Marcus说,Q3数据显示OpenAI企业增长82%,比Anthropic的76%还高,因为GPT-5.6 Sol更好用,而Anthropic的Fable 5则有点失望。
Artificial Analysis刚发了搜索API基准,用GPT-5.6 Luna测了7家提供商,帮你选搜索工具时看质量、成本、速度。
OpenAI官方晒了组省钱实测:Hypha AI用GPT-5.6 Luna把文档提取成本降到1/18,准确率还保住98%;RogoAI靠工具调用省了21%输入token。
OpenAI 的 GPT-5.6 Sol 在 ARC-AGI-3 上分数翻倍还多,token 还省了六倍,看看他们怎么做到的。
花 1 美元订阅 Command Code,再用 Codex Router 转发给 Codex,就能用上 GPT-5.6 Luna 和 Grok 4.5,这操作可以学一下。
LlamaIndex给LlamaParse加了新模式,专门抽长文档里的海量字段,准确率比Claude Code和Codex高10-20%,每个字段还带出处。
一个叫Faraday的27B智能体,把论文复现变成强化学习任务,在测试集上赢了Claude Opus 4.8和GPT-5.5,还把编码agent当工具用,有点意思。
OpenAI 的 GPT-5.6 Sol 在低推理强度下就超过了 GPT-5.5 的高推理强度表现,还更省 Token,你可以直接上手试试。