事件专题 ·多源确认

GPT-6.1 Sol在浏览器任务中表现优异

GPT-6.1 Sol在Browser Use Bench 2.1基准测试中获得了最高分。相比Astra模型,GPT-6.1 Sol的预估成本低7.8倍。Opus 5.5和Grok 4.7在该测试中得分更低且成本更高。GPT-6.1 Sol的95%提示词被缓存,缓存令牌价格比Astra便宜10倍。

当前结论

OpenAI的GPT-6.1 Sol在浏览器任务上击败了Astra、Opus和Grok,成本还低7.8倍,靠缓存技术实现。

11 个信源68° AI 热度最后更新 2026/10/1 22:26:28

证据链

11 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。