事件专题 ·多源确认

Claude Sonnet 5.5 在 Code Arena 排名第四

Claude Sonnet 5.5 (High) 在 Code Arena: WebDev 基准测试中获得 1699 分,排名第 4 位。该模型比排名第 3 的 Claude Fable 5.1 (Max) 和排名第 2 的 GPT-6 Astra (Max) 便宜 80%,每百万代币成本为 8 美元。相比 Sonnet 5 (High),该模型性能提升了 159 分,排名从第 37 位跃升至第 4 位。

当前结论

Anthropic 发布的 Claude Sonnet 5.5 性价比极高,在多个关键领域排名从第 30 多位跃升至第 4 位。

11 个信源83° AI 热度最后更新 2026/9/29 18:15:04

证据链

11 个信源
相关来源 4Artificial Analysis
查看原文
相关来源 6歸藏(guizang.ai)
查看原文
相关来源 10arXiv: DeepSeek
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。