Google 内测新模型 Carbon,编码能力被指接近 Claude Opus 5.5
Google 内部正测试新模型 Carbon,有员工说写代码的感觉像 Opus 5.5,编程正是 Gemini 目前的短板,想换工具写代码的可以留意。
据 Business Insider 援引知情人士报道,Google 正在内测新模型 Carbon,已部署到内部 AI 编程工具 Jetski 上,有员工称其编码能力“感觉像 Opus 5.5”。Carbon 在 9 月 30 日发布的 Gemini 4 Argon 之后训练,可能作为 Argon 升级或独立模型推出。此前在第三方编程测试 Terminal Bench 4 上,Argon 得分 57%,低于 Claude Sonnet 5.5(64%)、Claude Opus 5.5(60%)和 GPT-6 Astra(59%)。Google 9 月还放开了内部限制,允许全体工程师用 Claude 写代码。目前 Carbon 没有公开跑分和发布时间,Google 拒绝评论内部路线图。
据 Business Insider 援引知情人士报道,Google 内部在测试新模型 Carbon,有员工说编码能力“感觉像 Opus 5.5” Carbon 部署在 Google 内部的 AI 编程工具 Jetski 上。报道说,Google 9 月 30 日发布的 Gemini 4 Argon 用的是另一个内部版本 Barium-B,Carbon 是在它之后训练出来的新版本。Carbon 会作为 Argon 的升级推出,还是单独作为新模型发布,目前还不清楚。 Opus 5.5 是这次的参照对象,因为编程是 Gemini 目前的短板。Bloomberg 此前报道,有 Google 员工反映 Argon 跑分好看,真拿来写代码却不如预期。在第三方编程测试 Terminal Bench 4 上,Argon 得分 57%,低于 Anthropic 的 Claude Sonnet 5.5(64%)、Claude Opus 5.5(60%)和 OpenAI 的 GPT-6 Astra(59%)。Google 9 月还放开了内部限制,允许全体工程师用 Claude 写代码。 如果 Carbon 真能做到 Opus 5.5 的水平,用 Gemini 写代码的开发者会直接受益。不过“感觉像”只是一位匿名员工的主观评价,Carbon 没有公开跑分,也没有发布时间,Google 拒绝评论内部路线图。眼下外界能用的只有 Argon,而且它也只开放给了部分网络安全合作伙伴,付费 API 用户和 Google AI Ultra 订阅用户还要再等。 💬 19 🔄 2 ❤️ 18 👀 5964 📊 19 ⚡