8月13日晚上,DeepSeek 一口气干了三件事。先是公布 API 调价方案,几个小时后,V4 Pro 正式版悄悄上线,再晚一点,Harness 团队顶着那只黑鲸头像发了第一条推文,宣布 DeepSeek Harness 开发者预览版开放测试,源代码按 MIT 协议放到 GitHub。
这是 DeepSeek 第一款 Agent 产品。官方用一条公式说清楚了它的定位,Model 加 Harness 等于 Agent。模型是大脑,负责推理,Harness 是环绕在模型外面的整套执行系统,负责读文件、调工具、管理上下文、失败重试,让模型能连续工作几个小时。Claude Code 和 OpenAI Codex 做的事情,它都想做。
Harness 这个项目 5 月才在内部立项,负责人崔添翼,浙大计算机系出身,在 Jane Street 干了九年量化,今年 3 月加入 DeepSeek。8 月 2 日他公开征集内测用户,几十名全球开发者报名,内测群里有人直接喊出「宇宙最强」。保密协议压着,具体表现谁也没法细说,但这种兴奋情绪本身已经说明问题。
真正让社区炸开的是它的架构。DeepSeek 给 Harness 定的核心原则叫「一切皆插件」,底层跑在 Cordis 插件系统上。Cordis 元框架只负责插件的加载、卸载和依赖管理,剩下的全部由插件组成,模型、工具、技能、会话、沙箱、存储、Agent 循环、任务调度、用户界面,哪一块都能单独换掉。这和 VS Code 插件不是一个量级的东西,VS Code 的插件只是给编辑器加功能,Harness 的插件可以直接换掉 Agent 的大脑、工具箱、规则甚至整张脸。内测期间开发者几天内就写出了上百个插件,有人做了一个跨会话长期记忆插件,能在后台自我演化。
针对不同场景,Harness 预置了四种运行模式。标准模式加载完整工具组合,PTC 模式让模型生成一段代码来组合多轮工具调用,极简模式只保留 shell 和文件编辑两个工具,专门用来做模型基准测试,创造模式则允许检查当前运行时,在内存里试验新插件、组合新模式。其实 7 月 31 日 V4 Flash 正式版公测时,官方 API 文档里就写着用「DeepSeek Harness 极简模式(即将发布)」作为 Code Agent 任务的测试框架,这次发布算是把这层窗户纸捅破了。
会话日志的设计也很见功力。Harness 用仅追加的方式记录模型看到的一切,系统提示词、思维链、每一次工具调用和结果、子 Agent 调度、上下文注入,全部写进同一份日志。Trajectory 视图可以按来源逐条追溯,恢复、分叉、检索、回放都基于这条事件流。出了问题的任务可以像 git 分支一样拉出来重新跑,这在排查 Agent 长时间运行偏离目标的问题时特别有用。
安装只需要一行命令。装好 Node.js 之后,npx @deepseek-ai/dsh web 就能在浏览器里打开 Web UI。发布不到 24 小时,GitHub 上带 dsh-plugin 标签的插件仓库已经攒到 288 个,社区还自发搭了目录站和每日兼容性追踪仓库。有开发者说这是「向 Claude Code 说再见的那一天」,也有人拿它去跟开源的 Opencode 做对比。
当然,v0.1 还只是早期预览,仓库里明明白白写着后面会有破坏兼容性的改动,GitHub Releases 页面到现在还是空的。有上手的人吐槽,跑一个长任务能花半个多小时,对一个以快著称的公司来说有点意外。DeepSeek 自己也很坦诚,说很多细节有待打磨,核心插件和基础接口会快速迭代。
同一天发布的 V4 Pro 正式版给 Harness 补上了弹药。1.6 万亿参数、每 token 激活 490 亿、百万 token 上下文,官方强调的就是 Agent 性能。模型加框架一起开源,再加上 API 从 8 月 17 日起改成高峰低谷定价,这三件事放在一起看,DeepSeek 的意图很明确,它不再满足于当一个被调用的模型,开始争夺模型之上的开发者入口了。AI 编程工具市场 2025 年规模已经到 295.7 亿美元,预计 2030 年翻到 646.8 亿,这个入口值得一抢。
跑起来看看吧,288 个插件仓库里说不定就藏着下一个「宇宙最强」的雏形。
