DeepSeek Harness + V4-Pro:开源 Claude Code 替代上手

目录

📌 2026年8月,DeepSeek同时放出了两个大招:V4-Pro正式版上线,Harness开源。两件事合在一起,就是一套完整脱离闭源生态的Agent工作流方案——免费、开源、今天就能跑。

一、为什么这事值得关注

过去一年,Claude Code、Cursor、GitHub Copilot把"AI编程"的标准拉得很高。但它们都是闭源方案:模型是别人的、harness是别人的、数据不一定在自己手里、账单按美元计价。

DeepSeek这次不一样。

先是2026年4月发布V4预览版,1.6T参数的MoE架构、百万token上下文、性能对标Claude Opus级,API价格是闭源模型的零头。然后是2026年8月13日,DeepSeek Harness以MIT协议开源——这是DeepSeek自己做的Agent运行框架,对标Claude Code。

这两件事凑在一起意味着:你现在可以用DeepSeek的模型跑在DeepSeek的harness上,整个技术栈完全自主可控,没有一家闭源公司能随时掐断你的使用权。

这不是概念,这是今天就能落地的现实。

二、DeepSeek V4-Pro:参数、价格、能力

模型规格

V4-Pro是DeepSeek V4系列的旗舰款,核心参数如下:

  • 总参数量:1.6T(16万亿),MoE稀疏架构,每次推理只激活49B参数
  • 上下文窗口:100万token(1M),实测可用,不是理论数字
  • 最大输出:38.4万token(384K)
  • 权重协议:MIT,可商用,可本地部署
  • 发布日期:2026年4月24日预览版上线,2026年8月13日V4-Pro正式版(版本号deepseek-v4-pro-0813)发布

定价(实测可用)

这里的数据全部来自DeepSeek官方定价页面和多方交叉验证:

计费项V4-Pro(¥/百万tokens)V4-Flash(¥/百万tokens)
输入(缓存未命中)3元1元
输入(缓存命中)0.025元0.02元
输出6元2元

换算美元:V4-Pro输入约0.44/百万token,输出约0.87/百万token。这个价格是Claude Opus 4.6的约1/50,是GPT-5.5的约1/15。

缓存命中价的意义在于:如果你的Prompt有重复前缀(比如系统提示词、代码模板),第二次调用只收0.025元/百万token,实际成本接近白送。

三档推理强度

V4-Pro支持通过reasoning_effort参数控制推理强度:

  • 低(low):快速响应,适合简单对话
  • 中(medium):平衡模式,默认开启
  • 高/最大(high/max):深度推理,适合复杂Agent任务

复杂任务(代码重构、多步骤分析、长文档处理)建议把reasoning_effort拉到max。日常对话用默认模式即可,响应速度和成本都更优。

API接口兼容

V4-Pro同时暴露两套接口:OpenAI ChatCompletions格式和Anthropic兼容格式。前者用标准OpenAI SDK调用,后者可以直接替换Claude Code的API端点,三分钟完成切换。

三、DeepSeek Harness:开源Agent框架是什么

定位对比

Harness不是新模型,也不是API客户端。它的定位是"模型外面的运行系统"——负责把模型接入文件系统、终端、网页、代码工具,组织上下文、管理工具调用和任务执行。

这个概念最早由Addy Osmani提出,工程化公式是:

1
Agent = Model + Harness

同样的模型,换不同的harness,在Terminal Bench上的排名可以从Top 30拉到Top 5。差距不在模型参数里,在外面的运行系统里。

对比主流竞品:

方案性质模型定制性成本
Claude Code闭源Claude专有按Token计费
GitHub Copilot闭源GPT-4o/GPT-5o有限订阅制
Cursor闭源GPT-4o/Claude有限订阅制
DeepSeek HarnessMIT开源任意模型完全开放模型API+自托管

Harness的开源,意味着你可以在它上面跑DeepSeek V4-Pro、跑本地Ollama模型、跑任何兼容接口的模型,工具层完全自主。

架构设计

DeepSeek Harness的核心设计哲学是"一切皆插件":模型、工具、技能、会话、沙箱、存储、循环、调度、UI,所有Agent能力均由插件组合,可自由替换、灵活重组。

  • v0.1版本:2026年8月13日发布,开发者预览版,MIT协议
  • npm包名@deepseek-ai/dsh
  • 启动方式:安装Node.js后,一行命令即可在本机启动Web UI:npx @deepseek-ai/dsh web
  • GitHub:已在github.com/deepseek-ai开源(8月13日同步)

这个架构的好处是:你可以换掉任何一个组件。比如不想用内置的代码执行环境,换成Docker沙箱;不想用默认的上下文管理策略,自己写一个插件插进去。

对比Claude Code的关键差异

Claude Code是一个打包好的产品,好用但黑盒——你改不了它的工具循环逻辑,改不了它的上下文压缩策略,改不了它的沙箱行为。

DeepSeek Harness给你的是源代码和插件接口。改工具循环?改。换成自己的记忆系统?改。换个模型跑?插进去。

代价是:需要更多的配置工作,不是开箱即用的体验。

四、完全开源栈组合:三种上手路径

路径一:Harness + V4-Pro API(推荐新手)

最省事的组合。Harness负责Agent工作流,V4-Pro负责推理,按量付费,不需要自己维护模型。

步骤:

  1. 在DeepSeek开放平台注册,获取API Key
  2. 安装Node.js(18+)
  3. 运行 npx @deepseek-ai/dsh web
  4. 在Harness配置中填入DeepSeek API Key,模型选择deepseek-v4-pro

这个路径适合想体验完整Agent工作流但不想折腾本地部署的用户。

路径二:直接API调用(最轻量)

如果只需要模型能力,不需要Harness的完整工作流,直接用API接入自己的系统。

Python示例:

 1
 2
 3
 4
 5
 6
 7
 8
 9
10
11
12
13
14
15
16
from openai import OpenAI

client = OpenAI(
    api_key="你的DeepSeek API Key",
    base_url="https://api.deepseek.com/v1"
)

response = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[
        {"role": "system", "content": "你是一个高级代码审查员。"},
        {"role": "user", "content": "审查以下代码的潜在问题:\n" + open("main.py").read()}
    ],
    max_tokens=4096
)
print(response.choices[0].message.content)

Claude Code接入(Anthropic兼容模式):

~/.claude/settings.json中配置:

三分钟配置完,Claude Code跑在国产模型上。实测日常coding任务够用,复杂推理跟Opus 4.6思考模式还有差距,但价格是零头。

路径三:完全本地部署(最高自主)

如果对数据主权有要求,或者想彻底摆脱API依赖,可以本地部署。

V4-Flash(284B参数)可在高端消费级显卡上运行量化版本。V4-Pro(1.6T参数)完整版需要多卡集群,但HuggingFace上有量化权重可用。

注意:本地部署V4-Pro的量化版,效果和原生API有差距,不是所有人都值得折腾这个。

五、V4-Pro的使用场景判断

V4-Pro不是万能药,有它最适合的场景,也有它目前力不从心的地方。

适合用V4-Pro的场景:

  • 长上下文任务:代码库分析、整本书总结、长文档审查(1M上下文是真实可用的)
  • 高频API调用:成本敏感但需要旗舰级推理能力(日均调用量大时,省下来的费用很可观)
  • Agent任务:需要模型做工具调用、多步骤规划的任务(实测Agent benchmark已超越Claude Sonnet 4.5水平)
  • 数据隐私敏感:需要模型在自己控制的环境中运行(MIT协议,支持本地部署)

目前仍有差距的场景:

  • 极致复杂推理:Opus 4.6思考模式的复杂推理任务,V4-Pro还没完全追上
  • 多模态:V4-Pro是纯语言模型,不支持图像输入
  • 超长输出单次:虽然最大支持384K输出,但超长输出的质量稳定性还有优化空间

六、资源汇总

资源地址说明
DeepSeek官网deepseek.com模型API申请、定价页面
DeepSeek API文档platform.deepseek.com完整接口文档
GitHub(deepseek-ai)github.com/deepseek-aiHarness开源仓库
npm(@deepseek-ai/dsh)npmjs.com/package/@deepseek-ai/dshHarness包安装
HuggingFacehuggingface.co/deepseek-ai模型权重
OpenRouteropenrouter.ai/deepseek/deepseek-v4-pro第三方API代理
硅基流动siliconflow.cn国内V4-Pro API渠道

参考来源:

  1. DeepSeek官网 — 官方开放平台,API申请与定价
  2. DeepSeek V4技术报告(HuggingFace) — 1.6T参数架构与基准测试数据
  3. DeepSeek V4-Pro永久降价75%(博客园) — 永久定价0.435/0.435/0.87/百万token交叉验证
  4. DeepSeek V4 Pro正式版上线(企鹅号) — 2026-08-13正式版规格与定价确认
  5. DeepSeek正式开源Harness(企鹅号) — Harness v0.1 MIT协议开源,npm @deepseek-ai/dsh
  6. Claude Code + DeepSeek V4-Pro真实评测(博客园) — Anthropic协议接入实测,工具调用稳定性数据
  7. OpenRouter DeepSeek V4-Pro — 第三方API渠道

🎯 行动清单

  • 第一步:访问 deepseek.com/platform 注册账号,申请API Key(免费赠送额度)
  • 第二步:安装Node.js(18+),在终端运行 npx @deepseek-ai/dsh web 体验Harness Web UI
  • 第三步:用V4-Pro API跑一个简单任务(代码审查/长文档总结),感受1M上下文的真实能力
  • 第四步:把Claude Code接入DeepSeek Anthropic兼容端点,替换默认模型(ANTHROPIC_BASE_URL配置)
  • 第五步:在硅基流动(siliconflow.cn)注册,对比不同渠道的V4-Pro定价和响应稳定性

📖 延伸阅读


🔗 这个工具今天就能用:deepseek.com。花5分钟注册API Key,今天就能用V4-Pro跑第一个任务,省下的费用是自己的。

最后更新:2026-08-14

原文链接: https://www.17you.com/freeresources/deepseek-harness-v4-pro/ 已复制!
寻找合作和资源

如果你也对文章内容或者分享的资源和机会有兴趣,欢迎联系我。

请点击联系我


相关内容

发现新版本

当前站点有新版本可用。