模型多源确认87°

谷歌发布Gemini 4模型

精选理由

谷歌Gemini 4来了,百万token长上下文,多项基准领先,还支持量子算法优化和代码迁移。

谷歌发布Gemini 4模型,单次输出token上限提升至100万。在DeepSWE v1.1基准测试中得分为77.9%,在AutomationBench上得分为51.3%,在LVBench上得分为91.7%。定价为输入每百万token 2美元、输出每百万token 10美元,缓存输入享95%折扣。

原文 · Gorden Sun

谷歌发布Gemini 4,各项评分大幅领先!哈基米支棱起来了!

核心定位与规格:Argon 专为复杂的长周期工作流设计,单次输出 token 上限从 64K 大幅提升至 100 万 tokens。首发定价为输入每百万 token 2 美元、输出每百万 token 10 美元(缓存输入享 95% 折扣)。

内部工程实践:Google 内部已将其用于量子算法优化(效率提升 40%)、数据中心内存优化(释放超 300 TiB 内存)以及 C/C++ 到 Rust 的大规模代码库迁移。

企业与基准表现:在软件工程评估 DeepSWE v1.1(77.9%)、涵盖金融/法律/税务的 Vals Index、自动化基准 AutomationBench(51.3%)以及长视频理解 LVBench(91.7%)上均取得领先或 SOTA 成绩。

防御性网络安全:模型能自主发现、验证并修复漏洞,在 CWE-bench v1 上取得并列第一(68%)。Google 正通过 Fairwind Program 为受信安全人员提供无网络限制的安全防御版本。

安全与部署计划:强化了针对间接提示注入(Indirect Prompt Injection)、恶意滥用和意图失齐(Misalignment)的防护机制。目前正向受信任测试者开放,后续将逐步向 API 付费用户、Google AI Ultra 订阅者及广大企业和开发者推广。