主要来源Google AI Developers
查看原文事件专题 · 多源确认
Gemini 3.6 Flash 浏览器代理基准 68%,超越 GPT-5.6 和 Sonnet 4.6
Google DeepMind 推出 Gemini 3.6 Flash 模型,面向浏览器代理任务。在 Browser Use 的 BU Benchmark 上,Gemini 3.6 Flash 得分 68%。该成绩高于 GPT-5.6-sol 的 67% 和 Sonnet 4.6 的 62%。Opus 4.8 以 74% 领先,但 Gemini 3.6 Flash 成本远低于 Opus。该模型以 Flash 定价提供前沿级的 Web 代理能力。
当前结论
想低成本做浏览器自动化?Gemini 3.6 Flash 性价比炸裂,BU 基准 68% 比 GPT-5 还高,只比最贵的 Opus 差一点但便宜很多。
11 个信源81° AI 热度最后更新 2026/7/21 21:03:51
证据链
相关来源 1Browser Use
查看原文相关来源 2Jeff Dean
查看原文相关来源 3Geek
查看原文相关来源 4Philipp Schmid
查看原文相关来源 5宝玉
查看原文相关来源 6marktechpost
查看原文相关来源 7OpenRouter
查看原文相关来源 8GitHub
查看原文相关来源 9小互
查看原文相关来源 10Patrick Loeber
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。