Anthropic 发布 Claude Opus 5.5:追平 Fable 5.1,运行成本降 40%
Claude Opus 5.5 发布:追平 Fable 5.1,成本降四成 Anthropic 发布 Claude Opus 5.5,大部分工作上的表现追平了自家 Mythos 级的 Fable 5...
Anthropic 新模型追平自家顶级模型,价格还砍了四成,缓存读取降到 0.2 美元,跑 Agent 的开发者直接受益,比 GPT-6 Astra 便宜一半以上。
Anthropic 发布 Claude Opus 5.5,大部分任务表现追平自家的 Fable 5.1,运行成本比 Opus 5 少 40%。输入和输出单价为每百万 Token 4 美元和 20 美元,缓存读取从 0.5 美元降到 0.2 美元,对写代码、跑 Agent 的重度开发者影响最大。在 Terminal-Bench 4.0 上与 OpenAI 的 GPT-6 Astra 打平,成本约为对方的四成;写公司季度业绩报告的测试中,18 份报告有 16 份通过,Fable 5.1 和 Opus 5 一份都没过。限制方面,思考模式不能关闭,大部分网络安全任务会自动转给 Opus 4.8 处理。模型已在 Claude 全平台及 AWS、Google Cloud、Azure 上线。
Claude Opus 5.5 发布:追平 Fable 5.1,成本降四成 Anthropic 发布 Claude Opus 5.5,大部分工作上的表现追平了自家 Mythos 级的 Fable 5...
Claude Opus 5.5 发布:追平 Fable 5.1,成本降四成 Anthropic 发布 Claude Opus 5.5,大部分工作上的表现追平了自家 Mythos 级的 Fable 5.1。同样的任务,花费比上一代 Opus 5 少 40%。 省钱来自两方面:单价降了,完成同一件事用的 Token 也少了。输入和输出分别是每百万 Token 4 美元和 20 美元,比 Opus 5 便宜 20%。降得最多的是缓存读取,从 0.5 美元降到 0.2 美元。写代码、跑智能体(Agent)时,模型会反复读取同一批上下文,账单里大部分钱花在这一项上,所以对重度开发者来说,这项降价最实在。输出速度也快了 30% 以上。 订阅用户也有好处。Pro、Max、Team 套餐的五小时用量上限提高了,每人还额外获得一次限额重置,可以存起来,等哪天额度用完了再用。 能力上的变化,看几个实际案例更直观。一位早期测试者用它审计并修复一个 20 万行的代码库,不到 3 小时完成。Opus 5 做同样的事花了 20 多个小时,Token 用量是它的 2.5 倍。Anthropic 内部让它和 Fable 5.1 把负载均衡软件 HAProxy 从 C 语言改写成 Rust,两者都几乎通过了全部回归测试,Opus 5.5 用时 9.5 小时,Fable 5.1 用了 12 小时,Opus 5.5 的成本低 51%。 和 OpenAI 的 GPT-6 Astra 相比,在测试命令行多步骤任务的 Terminal-Bench 4.0 上,Opus 5.5 分数打平,成本约为对方的四成。Anthropic 自己也说,到了这个水平,跑分差距已经不太能反映实际使用中的差别。 做研究的人可能更在意另一项测试:让模型只靠网上检索写一份公司季度业绩报告,任何数字或引语是编的就算不合格。Opus 5.5 的 18 份报告里有 16 份过关,Fable 5.1 和 Opus 5 一份都没过。 文风也改了。Opus 5 常被反馈说话绕、爱用行话,Opus 5.5 会把最重要的结论放在最前面,也更遵守用户给的写作要求。 能力变强,限制也跟着来了。它在网络安全和生物领域的能力接近 Mythos 5.1,所以沿用 Fable 5.1 的安全防护:修自己代码里的漏洞没问题,但大部分网络安全任务会被自动转给更老的 Opus 4.8 处理;生物研究相关工作同样受限,高校实验室、药企等机构可以申请“生命科学验证计划”(Life Sciences Verification Program)来解除限制。面向安全从业者的验证通道会在未来几周开放。 开发者还要留意两点。一是思考模式不能再关闭。二是 8 月 31 日之后注册的 API 账号,无法再通过修改历史上下文来套取模型的推理过程。这是防“蒸馏”的措施,蒸馏指用大量账号批量抽取模型能力,拿去训练自己的模型。已有集成需要对照官方文档检查一遍。 Opus 5.5 现已在 Claude 全平台以及 AWS、Google Cloud、Azure 上线,API 模型名为 claude-opus-5-5。Sonnet 5.5 和 Haiku 5.5 会在未来几周陆续发布。 Claude @claudeai Introducing Claude Opus 5.5, the first model in our new Claude 5.5 family. It performs at the level of Claude Fable 5.1 for most tasks, and costs 40% less to run than Opus 5. Your browser does not support the video tag. 🔗 View on Twitter 🔗 View Quoted Tweet 💬 2 🔄 0 ❤️ 8 👀 4012 📊 3 ⚡