Gemini 3.6 Flash 发布:加量降价,Google 的意外惊喜

2026年7月21日,Google 悄悄在 AI Studio、Vertex AI 以及部分早期用户体验界面上线了 Gemini 3.6 Flash 和 Gemini 3.5 Flash Lite 两款模型。作为 Gemini 3.5 Pro 旗舰版本持续跳票期间的过渡之作,这次更新最大的惊喜不是功能,而是价格——Gemini 3.6 Flash 的输出价格竟然比上一代 3.5 Flash 还要便宜。

Gemini 3.6 Flash 的定价为每百万输入 tokens 1.50 美元,每百万输出 tokens 7.50 美元。对比上一代 Gemini 3.5 Flash 的 $1.50/$9.00,输出价格从 9 美元直接降到了 7.5 美元,降幅接近 17%。这不是简单的降价促销,而是 Google 在大模型价格战中的又一次主动出击——在输出质量提升的同时反向下调价格,给竞争对手的压力可见一斑。

从定位来看,Gemini 3.6 Flash 被 Google 描述为一款在速度和推理能力之间取得平衡的模型,专门为 Agent 任务和多模态工作流优化。它继承了 Flash 系列”快速响应、性价比高”的基因,同时在 Agent 能力上做了显著加强——意味着它能更好地处理多步骤规划、工具调用、自主决策这类需要”连续动作”的任务场景。模型的知识截止日期为 2026 年 3 月,算是目前业内较新的知识库之一。

与 Gemini 3.6 Flash 同场亮相的还有 Gemini 3.5 Flash Lite,这款产品的定价堪称”地板价”:每百万输入 tokens 仅 0.30 美元,每百万输出 tokens 2.50 美元。Google 对它的定位是超高吞吐量的”工作马”,适合大规模翻译、数据处理、内容审核等不需要深度推理但需要海量 tokens 的场景。这个定价策略很明显:Google 希望通过 Flash Lite 抢占那些对成本极度敏感的企业客户,把 OpenAI、Anthropic 的中等价位模型挤出竞争区间。

值得注意的是,这次两款 Flash 模型的发布正值 Google 旗舰产品 Gemini 3.5 Pro 遭遇持续延期之际。Gemini 3.5 Pro 是 Google 面向高端市场的核心产品,原计划今年上半年亮相,但因故推迟至今尚未全面开放。Google 选择在此时推出两款 Flash 过渡产品,既是为了维持市场热度和技术迭代节奏,也是向市场证明自己在大模型军备竞赛中没有掉队。

对于开发者而言,Gemini 3.6 Flash 的发布是一个值得关注的信号:这款模型已经在 AI Studio 和 Vertex AI 开放访问,技术文档和 API 接口与 Google 现有的生态体系完全兼容。对于那些正在评估 Claude、GPT-5 系列或者 Gemini 家族的开发者来说,Gemini 3.6 Flash 提供了一个新的高性价比选择——尤其是 Agent 类场景,Flash 系列的响应速度和成本优势在生产环境中往往是决定性因素。

而 Gemini 3.5 Flash Lite 则更像是一张”入场券”,它用极低的价格让更多中小型应用能够用上 Google 的基础模型能力,这在过去是难以想象的。大模型的成本壁垒正在被一点点瓦解,Google 正在用行动加速这个进程。