OpenAI 出了 GPT-5.6 的官方使用指南,教你怎么选模型、强度和速度,还有省 token 的提词技巧,比老版本更灵活。
OpenAI 发布了 GPT-5.6 的三个模型:gpt-5.6-sol(旗舰)、gpt-5.6-terra(平衡)和 gpt-5.6-luna(高吞吐)。每个模型支持 5 种推理强度(Light、Medium、High、Extra High、Ultra)和 2 种速度(Standard、Fast),共 30 种搭配。官方建议用户使用 GPT-5.6 时保持与之前版本相同的推理强度或降低一档。在提示词优化上,将冗长系统提示词缩减为精炼版本后,评测分数提升约 10%–15%,token 减少 41%–66%,成本降低 33%–67%。文档还强调,GPT-5.6 更主动,需明确权限边界,区分回答、修改、外部写入等操作。
3x Model:GPT-5.6 Sol、Terra、Luna 5x Effort:Light、Medium、High、Extra High、Ultra 2x Speed:Standard、Fast ...
3x Model:GPT-5.6 Sol、Terra、Luna 5x Effort:Light、Medium、High、Extra High、Ultra 2x Speed:Standard、Fast ChatGPT Work and Codex 里,有 30 种不同的搭配方式!!!怎么选呢?总不能每个任务都把模型和强度、速度都拉满吧,额度也不够用啊?! 看看 OpenAI Developer 最新发布的 GPT-5.6 最佳实践和迁移指南,从官方指导找一些确定性规则: developers.openai.com/api/docs/guide… 先看 GPT‑5.6 模型的三个等级 · gpt-5.6-sol:旗舰能力 · gpt-5.6-terra:能力与价格之间的平衡 · gpt-5.6-luna:面向高吞吐、效率优先的工作负载 对于推理强度 如果你之前用 GPT-5.5 或 5.4 已经有常用的推理强度,在使用 GPT-5.6 时,可以尝试: · GPT‑5.6 与相同推理强度 · GPT‑5.6 与低一档推理强度 原因是 GPT‑5.6 可能用更少 token 达到相同或更好的效果。但这只是需要验证的可能性,并非保证。medium 是标准和 Pro 模式的默认平衡点;high、xhigh 和 ultra/max 只应在真实评测显示质量提升时使用。 developers.openai.com/api/docs/guide… “更短的提示词”不是“少给必要信息” OpenAI 报告,在其内部评测中,将冗长系统提示词缩减为更精炼的版本,分数提高约 10%–15%,总 token 减少 41%–66%,成本减少 33%–67%。但这是厂商内部评测,没有披露完整任务构成、样本规模和评测方法,因此不应直接外推到所有业务。 应该保留的是:目标、必要背景、关键约束、授权边界、所需证据、成功标准和输出格式。 要处理长期堆积的提示词债务,例如: · 重复表达同一限制; · 大量已经成为模型默认行为的指令; · 不必要的角色设定和风格示例; · 与当前任务无关的工具; · 冗长但不精确的工具描述。 developers.openai.com/api/docs/guide… 模型越主动,权限边界越应清楚 GPT‑5.6 更擅长推断用户意图,也更主动、持续。但“更懂意图”并不等于可以省略关键边界。 文档建议明确区分: · 回答、解释、审查、诊断:可以检查材料并报告结果; · 修改、构建、修复:可以执行范围内的本地改动和非破坏性验证; · 外部写入、删除、购买、发布或明显扩大范围:必须确认。 深层含义是:授权规则已经不只是提示词风格,而是智能体系统的安全接口。 不必在每段提示词里反复写“先询问”,但需要一次性把可自主动作和确认边界定义清楚。 💬 5 🔄 0 ❤️ 0 👀 410 📊 6 ⚡