事件专题 ·多源确认

四大模型重塑文本、代码与智能体前沿

OpenAI的GPT-6.1 Sol在代码竞技场WebDev类别中排名第3,每百万代币成本8美元。随后Sonnet 5.5进入排行榜,Sol降至第4并退出帕累托前沿。Gemini 4 Argon在文本竞技场排名第1,代码竞技场WebDev排名第8(1679分),智能体竞技场排名第8。MiMo-V2.6-Pro和Flash作为开源模型分别进入智能体竞技场第5和第9名。

当前结论

OpenAI和Anthropic的新模型在代码竞技场竞争激烈,Gemini 4在多领域表现亮眼,开源模型MiMo和Flash也加入智能体竞技场。

11 个信源73° AI 热度最后更新 2026/10/2 17:24:13

证据链

11 个信源
相关来源 4Koray Kavukcuoglu
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。