Google发布Gemini 4 Argon模型
Google新发布的Gemini 4 Argon专注长程复杂任务,在编程、企业安全和视频理解领域都有亮眼表现。
Google在9月最后一天发布Gemini 4 Argon模型,目前处于受信测试阶段。该模型定位长程复杂任务,支持1M token输出上限,在编程、企业知识工作和网络安全三大方向表现优异。在DeepSWE v1.1基准上达到77.9%,法律和Zapier自动化基准排名第一,CWE-bench v1并列第一。
Gemini 4 赶在 9 月最后一天发布了,不过不叫 Pro,叫 Argon Argon(氩),我只在学化学时元素周期表里见过 😂,氩,元素符号 Ar,惰性气体。硫氯氩钾钙,死去的记忆。。。 Gemini 4 Argon 现在还在受信测试阶段,咱们外部用户还用不上,所以还见不到鹈鹕骑车、3D 建模和一句话做视频的帖子 😄 Gemini 4 Argon 核心定位是长程复杂任务,能在单次运行中持续保持深度推理,1M token 输出上限,覆盖三大方向:编程、企业知识工作、网络安全防御。 编程:DeepSWE v1.1 达 77.9%,主打真实世界的长周期软件工程任务 企业知识工作:领先 Vals Index(按 GDP 权重衡量金融、法律、税务等领域的经济影响),法律(Harvey 基准)和 Zapier 自动化基准(51.3%)排名第一 网络安全:可自主发现、验证并修补关键漏洞;CWE-bench v1 并列第一(68%);在 Wiz 的黑盒渗透测试基准上超过此前的 3.8 Flash Cyber 视频理解:LVBench 长视频理解 91.7% Google 内部实战数据,也是最能说明“长输出 + 深推理”价值的证据:帮助量子研究团队将子程序时空资源优化基准超越已发表结果 40%;Agent 团队找到内存优化方案,释放超 300 TiB 内存;完成 80 万行以上的 Fuchsia Zircon 内核 C/C++ 转 Rust 迁移,libgav1 的 Rust 移植版速度提升 2.7 倍。 Google DeepMind @GoogleDeepMind Introducing Gemini 4 Argon – our new frontier model. It’s built for complex workflows across coding, enterprise knowledge work, and cybersecurity defense – rolling out today to a set of trusted testers through our Fairwind Program. 🔗 View Quoted Tweet 💬 0 🔄 0 ❤️ 1 👀 536 ⚡