DeepSeek Harness + V4-Pro:开源 Claude Code 替代上手
📌 2026年8月,DeepSeek同时放出了两个大招:V4-Pro正式版上线,Harness开源。两件事合在一起,就是一套完整脱离闭源生态的Agent工作流方案——免费、开源、今天就能跑。
一、为什么这事值得关注
过去一年,Claude Code、Cursor、GitHub Copilot把"AI编程"的标准拉得很高。但它们都是闭源方案:模型是别人的、harness是别人的、数据不一定在自己手里、账单按美元计价。
DeepSeek这次不一样。
先是2026年4月发布V4预览版,1.6T参数的MoE架构、百万token上下文、性能对标Claude Opus级,API价格是闭源模型的零头。然后是2026年8月13日,DeepSeek Harness以MIT协议开源——这是DeepSeek自己做的Agent运行框架,对标Claude Code。
这两件事凑在一起意味着:你现在可以用DeepSeek的模型跑在DeepSeek的harness上,整个技术栈完全自主可控,没有一家闭源公司能随时掐断你的使用权。
这不是概念,这是今天就能落地的现实。
二、DeepSeek V4-Pro:参数、价格、能力
模型规格
V4-Pro是DeepSeek V4系列的旗舰款,核心参数如下:
- 总参数量:1.6T(16万亿),MoE稀疏架构,每次推理只激活49B参数
- 上下文窗口:100万token(1M),实测可用,不是理论数字
- 最大输出:38.4万token(384K)
- 权重协议:MIT,可商用,可本地部署
- 发布日期:2026年4月24日预览版上线,2026年8月13日V4-Pro正式版(版本号deepseek-v4-pro-0813)发布
定价(实测可用)
这里的数据全部来自DeepSeek官方定价页面和多方交叉验证:
| 计费项 | V4-Pro(¥/百万tokens) | V4-Flash(¥/百万tokens) |
|---|---|---|
| 输入(缓存未命中) | 3元 | 1元 |
| 输入(缓存命中) | 0.025元 | 0.02元 |
| 输出 | 6元 | 2元 |
换算美元:V4-Pro输入约0.44/百万token,输出约0.87/百万token。这个价格是Claude Opus 4.6的约1/50,是GPT-5.5的约1/15。
缓存命中价的意义在于:如果你的Prompt有重复前缀(比如系统提示词、代码模板),第二次调用只收0.025元/百万token,实际成本接近白送。
三档推理强度
V4-Pro支持通过reasoning_effort参数控制推理强度:
- 低(low):快速响应,适合简单对话
- 中(medium):平衡模式,默认开启
- 高/最大(high/max):深度推理,适合复杂Agent任务
复杂任务(代码重构、多步骤分析、长文档处理)建议把reasoning_effort拉到max。日常对话用默认模式即可,响应速度和成本都更优。
API接口兼容
V4-Pro同时暴露两套接口:OpenAI ChatCompletions格式和Anthropic兼容格式。前者用标准OpenAI SDK调用,后者可以直接替换Claude Code的API端点,三分钟完成切换。
三、DeepSeek Harness:开源Agent框架是什么
定位对比
Harness不是新模型,也不是API客户端。它的定位是"模型外面的运行系统"——负责把模型接入文件系统、终端、网页、代码工具,组织上下文、管理工具调用和任务执行。
这个概念最早由Addy Osmani提出,工程化公式是:
| |
同样的模型,换不同的harness,在Terminal Bench上的排名可以从Top 30拉到Top 5。差距不在模型参数里,在外面的运行系统里。
对比主流竞品:
| 方案 | 性质 | 模型 | 定制性 | 成本 |
|---|---|---|---|---|
| Claude Code | 闭源 | Claude专有 | 无 | 按Token计费 |
| GitHub Copilot | 闭源 | GPT-4o/GPT-5o | 有限 | 订阅制 |
| Cursor | 闭源 | GPT-4o/Claude | 有限 | 订阅制 |
| DeepSeek Harness | MIT开源 | 任意模型 | 完全开放 | 模型API+自托管 |
Harness的开源,意味着你可以在它上面跑DeepSeek V4-Pro、跑本地Ollama模型、跑任何兼容接口的模型,工具层完全自主。
架构设计
DeepSeek Harness的核心设计哲学是"一切皆插件":模型、工具、技能、会话、沙箱、存储、循环、调度、UI,所有Agent能力均由插件组合,可自由替换、灵活重组。
- v0.1版本:2026年8月13日发布,开发者预览版,MIT协议
- npm包名:
@deepseek-ai/dsh - 启动方式:安装Node.js后,一行命令即可在本机启动Web UI:
npx @deepseek-ai/dsh web - GitHub:已在
github.com/deepseek-ai开源(8月13日同步)
这个架构的好处是:你可以换掉任何一个组件。比如不想用内置的代码执行环境,换成Docker沙箱;不想用默认的上下文管理策略,自己写一个插件插进去。
对比Claude Code的关键差异
Claude Code是一个打包好的产品,好用但黑盒——你改不了它的工具循环逻辑,改不了它的上下文压缩策略,改不了它的沙箱行为。
DeepSeek Harness给你的是源代码和插件接口。改工具循环?改。换成自己的记忆系统?改。换个模型跑?插进去。
代价是:需要更多的配置工作,不是开箱即用的体验。
四、完全开源栈组合:三种上手路径
路径一:Harness + V4-Pro API(推荐新手)
最省事的组合。Harness负责Agent工作流,V4-Pro负责推理,按量付费,不需要自己维护模型。
步骤:
- 在DeepSeek开放平台注册,获取API Key
- 安装Node.js(18+)
- 运行
npx @deepseek-ai/dsh web - 在Harness配置中填入DeepSeek API Key,模型选择
deepseek-v4-pro
这个路径适合想体验完整Agent工作流但不想折腾本地部署的用户。
路径二:直接API调用(最轻量)
如果只需要模型能力,不需要Harness的完整工作流,直接用API接入自己的系统。
Python示例:
| |
Claude Code接入(Anthropic兼容模式):
在~/.claude/settings.json中配置:
三分钟配置完,Claude Code跑在国产模型上。实测日常coding任务够用,复杂推理跟Opus 4.6思考模式还有差距,但价格是零头。
路径三:完全本地部署(最高自主)
如果对数据主权有要求,或者想彻底摆脱API依赖,可以本地部署。
V4-Flash(284B参数)可在高端消费级显卡上运行量化版本。V4-Pro(1.6T参数)完整版需要多卡集群,但HuggingFace上有量化权重可用。
注意:本地部署V4-Pro的量化版,效果和原生API有差距,不是所有人都值得折腾这个。
五、V4-Pro的使用场景判断
V4-Pro不是万能药,有它最适合的场景,也有它目前力不从心的地方。
适合用V4-Pro的场景:
- 长上下文任务:代码库分析、整本书总结、长文档审查(1M上下文是真实可用的)
- 高频API调用:成本敏感但需要旗舰级推理能力(日均调用量大时,省下来的费用很可观)
- Agent任务:需要模型做工具调用、多步骤规划的任务(实测Agent benchmark已超越Claude Sonnet 4.5水平)
- 数据隐私敏感:需要模型在自己控制的环境中运行(MIT协议,支持本地部署)
目前仍有差距的场景:
- 极致复杂推理:Opus 4.6思考模式的复杂推理任务,V4-Pro还没完全追上
- 多模态:V4-Pro是纯语言模型,不支持图像输入
- 超长输出单次:虽然最大支持384K输出,但超长输出的质量稳定性还有优化空间
六、资源汇总
| 资源 | 地址 | 说明 |
|---|---|---|
| DeepSeek官网 | deepseek.com | 模型API申请、定价页面 |
| DeepSeek API文档 | platform.deepseek.com | 完整接口文档 |
| GitHub(deepseek-ai) | github.com/deepseek-ai | Harness开源仓库 |
| npm(@deepseek-ai/dsh) | npmjs.com/package/@deepseek-ai/dsh | Harness包安装 |
| HuggingFace | huggingface.co/deepseek-ai | 模型权重 |
| OpenRouter | openrouter.ai/deepseek/deepseek-v4-pro | 第三方API代理 |
| 硅基流动 | siliconflow.cn | 国内V4-Pro API渠道 |
参考来源:
- DeepSeek官网 — 官方开放平台,API申请与定价
- DeepSeek V4技术报告(HuggingFace) — 1.6T参数架构与基准测试数据
- DeepSeek V4-Pro永久降价75%(博客园) — 永久定价0.87/百万token交叉验证
- DeepSeek V4 Pro正式版上线(企鹅号) — 2026-08-13正式版规格与定价确认
- DeepSeek正式开源Harness(企鹅号) — Harness v0.1 MIT协议开源,npm @deepseek-ai/dsh
- Claude Code + DeepSeek V4-Pro真实评测(博客园) — Anthropic协议接入实测,工具调用稳定性数据
- OpenRouter DeepSeek V4-Pro — 第三方API渠道
🎯 行动清单
- 第一步:访问 deepseek.com/platform 注册账号,申请API Key(免费赠送额度)
- 第二步:安装Node.js(18+),在终端运行
npx @deepseek-ai/dsh web体验Harness Web UI - 第三步:用V4-Pro API跑一个简单任务(代码审查/长文档总结),感受1M上下文的真实能力
- 第四步:把Claude Code接入DeepSeek Anthropic兼容端点,替换默认模型(
ANTHROPIC_BASE_URL配置) - 第五步:在硅基流动(siliconflow.cn)注册,对比不同渠道的V4-Pro定价和响应稳定性
📖 延伸阅读
- DeepSeek DSpark 全解析:推测解码如何让 V4 推理快 4 倍
- llm-coding-agent 实战:Simon Willison 的一行命令编码 Agent
- freellmapi:16 家免费 API 一个端点全聚合,月省 17 亿 Token
🔗 这个工具今天就能用:deepseek.com。花5分钟注册API Key,今天就能用V4-Pro跑第一个任务,省下的费用是自己的。
最后更新:2026-08-14
如果你也对文章内容或者分享的资源和机会有兴趣,欢迎联系我。
相关内容
- 2026 自建邮箱完全指南:本地 LLM 杀垃圾邮件
- GLM-5.3 拆解:参数没涨,后训练如何硬拉 50%
- Qwen3.8-Max 全拆解:2.4T 国产旗舰值不值得用
- Sakana Fugu深度解析:7B小模型如何编排出顶级性能
- 微软连发7款MAI自研模型:350亿参数零蒸馏,正式向OpenAI亮剑
- LTX-2.5:开源视频生成,6.8 秒出 10 秒片
