Gemini 3.8 Flash 来了。
据《华尔街日报》、财联社等多家媒体 9 月 2 日报道,Google DeepMind 已于当天正式发布 Gemini 3.8 Flash,距离 8 月 13 日发布 3.7 Flash 不到三周。内部代号「Skimaki」,重点提升编程能力、内部测试中获得工程师倾向性选择。
三周一迭代,Google 放弃追旗舰
这已经是 Google 连续第三次在极短时间内推出新版 Flash。
- Gemini 3.6 Flash:7月21日发布
- Gemini 3.7 Flash:8月13日发布(距上次约3周)
- Gemini 3.8 Flash:9月2日发布(距上次不到3周)
Google CEO 皮查伊此前在财报会上表示,公司目标接近「每月一次」新模型发布。3.8 的速度印证了这一点——但代价是,旗舰 Pro 线的进度持续推迟。Gemini 3.5 Pro 原本预计 5 月发布,多个内部候选版本因「相对 Flash 提升不够显著」被废弃,至今未对外公开。
Flash 能连续快跑,和模型体量直接相关。知情人士告诉《华尔街日报》,调 Flash 占的算力少,几支团队可以同时试不同方案;同样的改动放到 Pro 上,要动的训练资源多得多,很难并行推进。
重点升级:编程能力大幅改善
3.8 Flash 的核心升级方向是编程和智能体工作流。
内部测试结果:Google 工程师在内部编程平台 Jetski 上进行对比测试,部分工程师更偏向 Gemini 3.8 Flash 而非 Anthropic 的 Claude Opus。不过这次测试的方法和完整结果并未对外公开。
3.7 遗留问题被修复:据 Threads 用户 invest.lab.hk 援引消息,3.8 修复了大量 3.7 为人诟病的问题,包括过度冗余的回复和无用信息(Slop),并大幅减少了长对话中的幻觉问题。
长对话优化:3.8 的另一个重点是改善多步骤代理工作流程的流畅度,这正是企业使用场景中最核心的需求。
定价不变,继续走性价比路线
Gemini 3.8 Flash 延续了 3.7 的上市定价(2026年底前优惠期):
| 模型 | 输入价格(每百万Token) | 输出价格(每百万Token) |
|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 |
| Gemini 3.7 Flash | $0.75 | $3.75 |
| OpenAI Luna | $0.20 | $1.20 |
| Claude Fable 5 | $10.00 | $50.00 |
3.7 的价格已经是前代的一半,但相比 OpenAI 的 Luna 层仍然偏高。Google 的策略是以发布频率和场景适配能力取胜,而非在价格上正面硬刚 OpenAI。
实际测试:3.7 曾超越 Claude Opus
值得注意的是,在一项真实世界分析任务的基准测试中,Gemini 3.7 Flash 的表现曾超越 Claude Opus 5 和 Claude Fable 5 等大型对手,且执行速度快得多。这说明 Flash 系列虽然体量小,但在具体任务上已经具备了和顶级旗舰正面竞争的能力。
Pro 线还在拖,Gemini 4 预训练已完成
旗舰线的消息:Gemini 3.5 Pro 多次推迟,Gemini 4 预训练评估表现良好,但后训练尚未完成。
DeepMind 近期还经历了管理层调整——联合创始人 Demis Hassabis 已卸任日常运营职责,专注于对外事务。接任者 Koray Kavukcuoglu 已向员工强调将加快模型开发节奏。
Gemini 3.8 Flash 目前已通过 Google AI Studio 和 Gemini API 提供,开发者可即刻体验。
