Grok 4.5 进入前沿模型梯队,Coding Agent 得分 76 与 GPT-5.5 持平

Grok 4.5 已进入接近前沿模型的梯队,强项集中在 agentic knowledge work…

精选理由

Grok 4.5 在代码智能体任务上得分和 GPT-5.5 一样高,但 token 消耗只有三分之一,价格还更便宜,做 agent 开发选它很划算。

AI 摘要

Grok 4.5 在 Coding Agent Index 得分 76,与 GPT-5.5 xhigh in Codex 同分,略低于 Fable 5 max in Claude Code。价格为输入 $2/1M tokens、输出 $6/1M tokens,cache hit 折扣至 $0.5/1M input。平均总 token 仅 1.9M,远低于 Fable 5 的 7.2M 和 GPT-5.5 的 6.2M。Elon Musk 披露参数量约 1.5T,上下文窗口 500k tokens。支持可配置 reasoning 和视觉输入,性价比优势明显。

原文 · 岚叔

Grok 4.5 已进入接近前沿模型的梯队,强项集中在 agentic knowledge work…

Grok 4.5 已进入接近前沿模型的梯队,强项集中在 agentic knowledge work 和 coding agent,最大卖点是性价比和 token 效率 超过了Google Gemini 系列

Coding Agent 表现: Grok 4.5 在 Grok Build 中的 Coding Agent Index 得分 76 与 GPT-5.5 xhigh in Codex 同分,略低于 Fable 5 max in Claude Code

成本优势很明显: 价格: 输入 $2 / 1M tokens,输出 $6 / 1M tokens。 cache hit 价格折扣 75%,即 $0.5 / 1M input tokens。

支持可配置 reasoning 和视觉输入。

上下文窗口 500k tokens,比 Grok 4.3 的 1M 缩小。

且成本优势不只来自定价,也来自更少 token 消耗 Coding Agent Index 平均总 token: Grok 4.5:1.9M Fable 5:7.2M GPT-5.5:6.2M

模型参数: Elon Musk 披露 Grok 4.5 是前代 3 倍大,约 1.5T 参数。

晚点给大家带来测评结果

Grok 4.5 进入前沿模型梯队,Coding Agent 得分 76 与 GPT-5.5 持平 · AI 热点