主要来源Sualeh Asif
查看原文事件专题 · 多源确认
SpaceXAI 发布 Grok 4.5,在代理知识工作基准上排名第四
SpaceXAI 发布了 Grok 4.5,在 GDPval-AA v2 基准上以 Elo 1543 排名第四,仅次于 Anthropic 的最新 Claude 版本。每个任务的成本为 0.49 美元,低于 GLM-5.2 和 Kimi K2.6,且比排名更高的模型便宜近 90%。该模型在性能与成本的帕累托前沿上表现突出。
当前结论
Grok 4.5 在代理知识工作基准上排第四,每个任务只要 49 美分,比前面的模型便宜 90%,性价比很能打。
11 个信源71° AI 热度最后更新 2026/7/8 20:12:29
证据链
相关来源 1Geek
查看原文相关来源 2IT之家
查看原文相关来源 3小互
查看原文相关来源 4berryxia
查看原文相关来源 5lmarena.ai
查看原文相关来源 6The Rundown AI
查看原文相关来源 7marktechpost
查看原文相关来源 8elvis
查看原文相关来源 9量子位
查看原文相关来源 10Decoder
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。