专题 · 深度求索
DeepSeek 系列完全指南
DeepSeek 是这份名单里唯一的开源派:从 V2 的 MLA 到 V4 的百万上下文,它反复证明「低成本 + 开源权重」也能做出前沿模型。2025 年 1 月 R1 开源震动硅谷,2026 年 V4.1-Flash 又把 Terminal-Bench 2.1 推到 90.6%。下面按时间梳理,本站报道过的事件都附原文链接。
一句话看懂当前位置:最新旗舰是 V4.1-Flash(原生多模态、非对称结构),高性价比档是 V4-Flash,开源编程工具链是 MIT 协议的 DeepSeek Harness。
- 150 篇站内 DeepSeek 相关报道
- 90.6%V4.1-Flash 的 Terminal-Bench 2.1 得分
- 15.8 万亿V4.1-Flash 单周调用 token(全球第一)
当前阵容速览(2026 年 9 月)
价格与规格整理自公开发布信息,可能随官方调整变化;使用前请以 DeepSeek 官网为准。
| 型号 | 定位 | 发布 | 备注 | 状态 |
|---|---|---|---|---|
| DeepSeek V4.1-Flash | 最新旗舰 | 2026-09-10 | 原生多模态,非对称结构 | 可用 |
| DeepSeek V4-Pro | 高性能档 | 2026-08-13 | 峰值 27 元 / 百万输出 | 可用(迁移计划已撤回) |
| DeepSeek V4-Flash | 高性价比档 | 2026-07-31 | Terminal Bench 2.1 = 82.7 | 可用 |
| DeepSeek V4-Flash-Vision-Exp | 多模态视觉 | 2026-08-22 | 权重已 MIT 开源(168GB) | 可用 |
| DeepSeek Harness | 开源编程 Agent | 2026-08-14 | MIT、一切皆插件 | 开发者预览 |
| DeepSeek V3.2 | 上一代 | 2025-12-01 | 首个把思考融入工具使用 | 仍可用 |
发展时间轴
共 31 个节点,紫色实心点为对行业格局影响较大的事件。
- 2023 年
-
2023-11-02
DeepSeek Coder 发布
以代码模型切入,从第一天就走开源路线。
-
2023-11-29
DeepSeek-LLM 发布
通用基座首批开源权重,确立「小团队 + 高效率」的技术叙事。
- 2024 年
-
2024-01-11
DeepSeek-MoE
早期 MoE 探索,用稀疏激活换推理成本。
-
2024-05-06
DeepSeek V2:MLA 注意力机制
多头潜在注意力(MLA)让 KV 缓存大幅缩小,把长上下文推理成本压下来,也定义了此后 V3、R1 的架构底座。
-
2024-06-17
DeepSeek Coder V2
编码能力对标当时的闭源一线,开源生态开始围绕它生长。
-
2024-09-05
DeepSeek V2.5
合并 Chat 与 Coder 两条线,简化模型选型。
-
2024-11-20
DeepSeek-R1-Lite 预览版
推理模型路线首次公开,网页端先行、暂不开放 API。
-
2024-12-26
DeepSeek V3 发布
671B MoE,训练成本被公开到远低于同规模模型的水平,「低成本也能做出前沿模型」第一次有了硬证据。
- 2025 年
-
2025-01-20
DeepSeek R1 正式发布并开源权重:震动硅谷的一刻
MIT 协议开源 660B 权重并同步放出 6 个蒸馏小模型,推理性能对标 OpenAI o1;1 月 27 日登顶中美 App Store 免费榜,在美区下载量超过 ChatGPT,引发硅谷连锁反应。
站内报道:DeepSeek 本地部署教程(Mac 版) -
2025-03-24
DeepSeek V3-0324
V3 的第一次重要更新,编码与推理继续上探。
-
2025-05-28
DeepSeek R1-0528
编程能力达到国际一线,腾讯多款 AI 应用当日接入。
-
2025-08-21
DeepSeek V3.1
混合架构:一个模型同时提供「思考」与「非思考」两种模式。
-
2025-09-22
DeepSeek V3.1-Terminus
缓解中英文混杂与异常字符问题,优化 Code Agent 与 Search Agent 表现。
站内报道:DeepSeek 发布 V3.1-Terminus:强化 Agent 能力 -
2025-09-29
DeepSeek V3.2-Exp
引入稀疏注意力(DSA),训练推理提效,API 价格直降 50% 以上。
-
2025-12-01
DeepSeek V3.2 正式版
强化 Agent 能力,是首个把「思考」融入工具使用的模型,拿下 IMO、CMO、ICPC、IOI 金牌。
站内报道:DeepSeek V3.2 正式发布:超越 GPT-5 水平 - 2026 年
-
2026-03-13
V3.2 强化 Agent 能力;V4 进入预告期
站内同期报道 V4 将是 1 万亿参数 MoE 并原生支持多模态。
站内报道:DeepSeek-V3.2 正式版发布:强化 Agent 能力,融入思考推理 -
2026-04-24
DeepSeek V4 预览版上线并开源:迈入百万上下文
百万字超长上下文正式可用,同时开源权重;站内此前已有「V4 月底发布前夜」的连续追踪。
站内报道:DeepSeek V4 加入战场 -
2026-05-06
DeepSeek TUI 冲上 GitHub trending
终端里的 AI 编程助手一个月冲到 GitHub 趋势榜,开源生态开始自转。
站内报道:开源的胜利:DeepSeek TUI 一个月冲上 GitHub trending -
2026-05-22
首轮融资飙升至 700 亿元
梁文锋承诺押注 AGI 而非短期变现。
站内报道:DeepSeek 首轮融资飙升至 700 亿元,梁文锋承诺押注 AGI -
2026-05-23
V4-Pro 永久降价 75%
价格打至原价 1/4,百万 token 仅需 2 分钱,「价格屠夫」名号坐实。
站内报道:DeepSeek 宣布 V4-Pro 永久降价 75% -
2026-06-16
V4.1 开始灰度测试
代码能力「天差地别」,知识截止日期跃升至 2026 年。
站内报道:DeepSeek V4.1 开始灰度测试 -
2026-06-19
V4 全量上线识图模式
「那只盲眼鲸鱼终于睁开了眼」——多模态能力补齐。
站内报道:DeepSeek V4 全量上线识图模式 -
2026-06-27
DSpark 推理加速框架开源
联合北大开源,推理速度提升 60%–85%。
站内报道:DeepSeek 发布 DSpark:推理速度提升 60%–85% -
2026-06-29
V4 正式版定档 7 月中旬,引入峰谷定价
高峰时段价格翻倍,让算力成本第一次被显式定价。
站内报道:DeepSeek V4 正式版 7 月中旬上线:引入峰谷定价机制 -
2026-07-31
DeepSeek V4-Flash 正式版
Terminal Bench 2.1 冲到 82.7,Agent 能力大幅超越预览版。
站内报道:DeepSeek V4 Flash 正式版来了:Terminal Bench 2.1 冲到 82.7 -
2026-08-07
预告 API 大幅涨价
「价格屠夫」也顶不住算力成本,低价叙事出现转折。
站内报道:DeepSeek 预告 API 大幅涨价 -
2026-08-13
DeepSeek V4-Pro 正式版上线
Agent 跑分直逼 Fable 5,API 价格一分没涨;同日涨价靴子落地,8 月 17 日起 V4 Pro 峰值输出 27 元。
站内报道:DeepSeek V4 Pro 正式版突袭上线 -
2026-08-14
DeepSeek Harness 开发者预览版:MIT 开源叫板 Claude Code
「一切皆插件」的开源编程 Agent,站内随后出了安装、插件安装、插件大盘点等成套教程。
站内报道:DeepSeek Harness 开发者预览版发布,一切皆插件 -
2026-08-22
首个多模态模型 V4-Flash-Vision-Exp 上线
一千张图 1.15 元,视觉 Agent 能力直逼 Opus 4.8。
站内报道:DeepSeek 上线首个多模态模型 V4-Flash-Vision-Exp -
2026-08-23
计费再调整:周末全天按谷底价
把「什么时候跑」也变成成本变量。
站内报道:DeepSeek 又调计费规则,周末全天按谷底价结算 -
2026-09-10
DeepSeek V4.1 Flash 正式发布
原生多模态视觉理解 + 全新非对称模型结构,能力更强、速度更快、成本更低;Terminal-Bench 2.1 拿到 90.6%,是目前公开记录里的最高分。
站内报道:DeepSeek V4.1 Flash 正式发布:官网三入口合一 -
2026-09-12
撤回 V4 Pro 强制迁移计划
宣布继续保留 V4 Pro 服务且价格不变,用户与开发者的迁移节奏被尊重。
站内报道:DeepSeek 撤回 V4 Pro 强制迁移计划 -
2026-09-20
调休日计费规则明确
中秋国庆十天「半价窗口」,V4.1-Flash 空闲价低至 0.02 元/百万 token。
站内报道:DeepSeek 明确调休日计费规则:十天半价窗口 -
2026-09-21
V4-Flash-Vision-Exp 权重开源;全球调用量登顶
168GB、MIT 协议、48 个 Safetensors 分片,可私有化部署;同期全球大模型周调用量达 129 万亿 token,V4.1-Flash 以 15.8 万亿登顶、环比涨 219%。
站内报道:DeepSeek-V4-Flash-Vision-Exp 权重开源:168GB、MIT 协议
