DeepSeek 在 V4-Pro API 提价之前将 coding-agent harness 开源
Harness v0.1 让开发者切换模型、工具和运行时,而更高的 V4-Pro 费率将于 8月16日生效。
By RuntimeWire Staff · Published
Primary source: VentureBeat
Why it matters
DeepSeek is using open-source agent infrastructure to expand distribution beyond its API. The same launch raises the cost of running the long, cache-heavy workflows Harness is built to support.

Liang Wenfeng's DeepSeek (@deepseek_ai) 在 8 月 13 日发布了一个开源运行时,用于构建编码代理,这将其推向超越模型 API 的领域,并进入由 Anthropic 的 Claude Code 和 OpenAI 的 Codex 控制的开发者工具链。该发布与 DeepSeek-V4-Pro 的普遍可用版本同时到来,并伴随计划于 8 月 16 日生效的提价。
DeepSeek's official changelog 确认 V4-Pro 在 8 月 13 日已进入 DeepSeek 的应用、网页界面和 API。VentureBeat 报道 表示 DeepSeek Harness v0.1 同日以 MIT license 进入开发者预览。
此次配套发布标志着 Liang 的范围变化——这位工程师和量化金融创始人在创立 DeepSeek 之前曾建立 High-Flyer hedge fund,并于 2023 年成立 DeepSeek。DeepSeek 起初将资源集中在模型研究上,而不是复杂的消费者应用。Harness 将 DeepSeek 直接推进到确定模型如何读取文件、调用工具、执行命令并在多个步骤中维持工作的运行时层。
围绕模型的开放运行时
DeepSeek Harness,也称为 dsh,是基于 Cordis 插件框架构建的。其核心设计原则是几乎每个组件都可以被替换:模型、工具、技能、会话、沙箱、存储、代理循环、编排和用户界面。
开发者可以通过以下命令启动本地网页界面:
npx @deepseek-ai/dsh web
标准代理模式可以检查和编辑文件、运行 shell 命令、搜索本地文件和网络、保持计划、调用可重用技能、将任务委派给子代理并应用审批策略。DeepSeek 还提供 Python SDK 以及针对工具组合、精简基准测试和自定义代理创建的模式。
模型本身也是一个插件。DeepSeek 的 provider documentation 支持 Anthropic、OpenAI、Codex、Amazon Bedrock、Google Vertex AI、Microsoft Azure 以及自定义端点,当然也支持 DeepSeek 的 API。这使得 Harness 成为一个与模型无关的框架,即便 DeepSeek 为 V4-Pro 和 V4-Flash 获得了一个自然的分发渠道。
目前,Harness 与 Claude Code 和 Codex 所处的产品层级不同。Anthropic 和 OpenAI 已经在终端、开发环境、云任务和仓库工作流中构建了托管的编码产品。DeepSeek 正在发布一个可组合的运行时和本地界面,开发者可以检查、分叉并重建它。
DeepSeek 也警告说 Harness 仍然是开发者预览版,并将收到破坏兼容性的更改。MIT 许可证消除了商业使用的法律障碍,而不稳定的接口提高了今天在生产环境部署它的工程成本。
兴趣的增长速度超过了软件的成熟度。GitHub 在 8 月 14 日显示该仓库约有 94,000 个 stars 和 8,600 个 forks。这些数字衡量的是发布时的关注度,而不是活跃安装或生产采用率。
V4-Pro 达到普遍可用
DeepSeek 在 4 月 24 日首次以预览形式推出 V4 系列。DeepSeek 表示 V4-Pro 具有 1.6 万亿总参数,其中每个 token 激活 490 亿参数。8 月 13 日的构建被标识为 DeepSeek-V4-Pro-0813,定位于编码和长时间运行的代理任务。
DeepSeek 表示此普遍可用版本在 Terminal Bench 2.1 上得分 87.9、在 DeepSWE 上得分 62.7、在 Humanity's Last Exam(使用工具)上得分 60.0。这些是供应商报告的结果,且若干比较包含 DeepSeek 的内部测试集。此次发布还增加了三种推理强度设置——low、high 和 max——以及对 OpenAI Responses API 格式的原生支持和 Codex 的配置。
Harness 与这些基准声称密切相关。在其 7 月 31 日的 V4-Flash 发布说明中,DeepSeek 表示其公开的代码代理评估使用了当时未发布的 Harness 的最小模式,仅配置了一个持久 shell 和一个文件编辑工具。发布 Harness 为开发者提供了一条路径,去检查并重现模型周围运行时的更多内容——工具定义、提示和执行循环都可能实质性地影响代理得分。
DeepSeek 重置 API 定价
DeepSeek 将于 8 月 16 日 16:00 UTC(东部时间中午 12 点)将其统一的国际 API 费率替换为高峰和非高峰定价。高峰时段为 01:00 至 04:00 UTC 以及 06:00 至 10:00 UTC。所有其他时段将使用非高峰费率。
对于 V4-Pro,此次变动在各个层面均为上涨:
| Per 1 million tokens | Current flat rate | New off-peak rate | New peak rate |
|---|---|---|---|
| Cached input | $0.003625 | $0.022 | $0.044 |
| Uncached input | $0.435 | $0.66 | $1.32 |
| Output | $0.87 | $1.98 | $3.96 |
即便是折扣后的费率也将缓存输入价格提高约 507%,未缓存输入提高 52%,输出提高 128%。在高峰时段,缓存输入成本约为当前费率的 12 倍,而输出则上涨了 355%。
这一组合为 DeepSeek 提供了更广泛的开发者策略。Harness 可以作为跨多个模型提供商的开放基础设施扩散,而 V4-Pro 则成为并列其上的默认商业端点。开发者在获得对代理运行时的控制权的同时,也失去了一部分原先使 DeepSeek 对于大量缓存、长时间运行工作负载有吸引力的定价优势。
此次发布还将 DeepSeek 的代理基准结果和 API 经济性放在了同一框架下。长会话、仓库分析和子代理工作流会消耗反复的输入和输出 token。Harness 的设计是让这些工作负载更容易构建,而与此同时 DeepSeek 对在 V4-Pro 上运行它们收取了大幅更高的费用。