谷歌发布Gemini 4 Argon:输出上限百万Token,13项基准领先,定价与GPT-6.1 Sol看齐

谷歌终于发布了自去年年底以来的首款旗舰大模型。当地时间9月30日,谷歌正式推出 Gemini 4 Argon,并一口气将输出上限从上一代的6.4万 token 直接拉到100万 token,增幅超过15倍。这是继 GPT-6.1 Sol 发布次日,谷歌对 OpenAI DevDay 节奏的正面回应。

定价与 Sol 看齐,首发期后翻倍

Argon 首发期间定价与 GPT-6.1 Sol、Claude Sonnet 5.5 完全一致:输入 $2/百万 token,输出 $10/百万 token,缓存输入再享95%折扣。首发期结束后将调整为 $4 输入 / $20 输出——涨幅一倍。首批仅通过 Fairwind 安全计划向经过验证的网络安全合作伙伴开放,付费 API 客户和 Google AI Ultra 订阅者紧随其后,普通用户尚无具体时间表。

知识工作与长文本能力大幅领先

在谷歌公布的18项基准测试中,Argon 在13项取得领先。最大优势出现在知识工作领域:在 Vals Index(覆盖金融、法律、税务等工作)得68.9分,超越 GPT-6 Astra(63.1分)和 Claude Opus 5.5(67.0分);在 DeepSWE v1.1(真实长程软件工程任务)得分77.9%,同样领先 Astra(74.1%)和 Opus 5.5(74.2%)。不过在复杂多步技术任务(FrontierSWE v2)和沙盒命令行任务(Terminal-Bench 4.0)上,Argon 仍落后于 Astra 和 Opus 5.5。

Argon 的超长输出能力也直接体现在实际业务中。谷歌透露,内部团队已用它将约3.2万行 C/C++ 代码迁移至 Rust,优化后运行速度达到原版的2.7倍;量子研究团队借助它设计更优算法;数据中心团队分析性能数据后实施内存优化,估计可释放超过300 TiB 内存容量。

士别七个半月,Gemini 终于有了一款在知识工作和长上下文上能与前沿模型正面竞争的产品。

相关阅读:谷歌Gemini Skills全面免费:Gems 11月17日停用,斜杠指令接棒