DeepSeek警告:在压低美国竞争对手价格后将大幅提高API价格
Liang Wenfeng 的实验室尚未公布新的费率或生效日期,迫使开发者在定价时将一个未确定的涨幅考虑在内。
By Ryan Merket · Published
Primary source: Bloomberg Technology
Why it matters
DeepSeek's low rates forced rival labs to defend their inference economics. A broad increase would test whether developers chose V4-Flash for its model quality or its subsidy-sized price advantage.

Liang Wenfeng 正在准备提高在 DeepSeek 的定价,试验杭州实验室是否能将其低成本模型带来的开发者需求转化为更大规模的 API 收入流。
DeepSeek 在其 API 定价页面 添加了一则警告,称计划在“近期”对其所有 API 服务提价,并“预计会有显著上涨”。DeepSeek 尚未说明新的费率或生效日期,并表示最终定价方案将由未来的官方通知确定。Bloomberg 在8月5日晚报道了这一拟议涨价。
该公告为那些基于 DeepSeek 当前费率卡构建产品的开发者带来了一个异常大的未知因素。DeepSeek-V4-Flash 在提示未从缓存检索时,每百万输入令牌收费 $0.14,缓存的每百万输入令牌收费 $0.0028,输出每百万令牌收费 $0.28。V4-Pro 在同样的三类计费下,分别为 $0.435、$0.003625 和 $0.87。
截至8月6日,这些价格仍然有效。DeepSeek 的警告未向客户提供任何依据来计算涨价后相同工作负载的费用。该措辞也指向一次整体的 API 重新定价,而非对某一模型或某类令牌的狭义调整。
DeepSeek 正在扩大此前的定价逆转
The South China Morning Post 在6月30日报道 称,DeepSeek 计划在北京的两个每日高峰时段将 V4 API 价格翻倍,报道援引了发给客户的电子邮件。报道指出,DeepSeek 将该政策归因于资源分配和服务稳定性。
新的警告更为广泛。DeepSeek 的定价页面描述了“整体定价”的提升,并未将变动限定在高峰时段。目前尚不清楚 DeepSeek 是否会用新的方案取代此前基于时间的政策、在其下增加更高的基础费率,或采用不同的计费结构。
此举发生在数月来 Wenfeng 将价格作为分发武器的背景下。DeepSeek 在 4月24日 发布了 V4,然后以低令牌费率、更快的 Flash 变体、100万令牌的上下文窗口和对工具调用的支持将其推入开发者工作流。7月31日的更新为编码代理在不改变模型架构的情况下添加了对原生 Responses API 的支持,正如 RuntimeWire 报道。
随后的独立基准测试将 V4-Flash 在测得的智力水平上置于价格远高得多的模型附近,同时在基准任务上的成本异常低廉。RuntimeWire 在8月3日报道,Artificial Analysis 在其测试中测得每项任务的成本约为 3 美分,约为 Claude Fable 5 的 105 分之一。
这种比较使得 DeepSeek 的定价对竞争实验室而言难以忽视。它也给了开发者在更换模型提供商时容忍运营工作量的理由。若大幅上涨,这一激励将被削弱,不过在 DeepSeek 发布费率表之前,影响无法衡量。
代理工作负载会放大小幅费率变动
该价格决定对运行代理(agent)的开发者影响最大,在此类场景中,一次用户请求可能导致为了规划、工具使用、代码生成、测试与修正而反复调用模型。在 DeepSeek 目前的计费计划下,输出令牌的费用也高于未缓存的输入令牌,因此较长的推理轨迹和生成的代码可能主导账单。
DeepSeek 一直在将 V4-Flash 引向恰好这些工作负载。当前 API 支持思考和非思考模式、JSON 输出、工具调用以及最多 384,000 令牌的输出。V4-Flash 已提供对 Responses API 的支持,但在定价页面上 V4-Pro 尚未列出此项支持。
在 DeepSeek 7 月降价后,RuntimeWire 审视了代理利润率问题:当一个产品在单一客户操作后端进行数十次调用时,低每令牌费率仍会产生显著的推理成本。一次广泛的上涨会在这些循环中放大并迫使初创公司重新审视使用限制、缓存策略和模型路由策略。
DeepSeek 的缓存命中折扣可能变得更加重要。在 $0.0028 每百万令牌的价格下,缓存的 V4-Flash 输入目前只需未缓存输入的五十分之一。因此,拥有可重复的系统提示或稳定上下文的开发者可以将一部分工作负载从完整的输入费率中屏蔽出来。DeepSeek 尚未说明在重新定价后该比例是否会保留。
Wenfeng 更接近商业化
Wenfeng 在创办 DeepSeek 之前,与人共同创立了量化对冲基金 High-Flyer,并曾在浙江大学学习工程学。High-Flyer 的交易业务在 Wenfeng 于 2023 年创办 DeepSeek 之前就已使用机器学习并积累了计算基础设施。这种支持让 DeepSeek 有空间优先开展研究,而不必在初期依赖传统风投资金。
Wenfeng 公开将该实验室定位于基础研究以及中国在原创 AI 进展方面的能力,而非跟随美国实验室的工作。DeepSeek 的开放研究发布支持这一立场:其 GitHub 组织 发布了模型代码和基础设施项目,DeepSeek-V3、DeepSeek-R1、FlashMLA 以及 3FS 分布式文件系统的仓库吸引了大量开发者使用。
API 定价位于这一研究战略的商业端。为热门模型提供服务需要持续的推理能力,且随着使用量上升以及代理工作负载消耗更长的上下文和输出,激进的费率变得更难维持。峰值小时定价通过在可预测的需求窗口提高收费来应对拥塞。一次整体的涨价将使 DeepSeek 在全天使用上获得更大的使用边际。
如果最终费率仍远低于竞争的高端 API,DeepSeek 仍能在保留部分成本优势的同时提高价格。这正是该公告背后的押注。Wenfeng 首先用低价吸引开发者使用 DeepSeek 的模型;他现在正在测试当访问成本更高时,有多少这类需求会留下来。
缺失的费率表将决定这是一次正常化还是战略性变动。温和的涨价仍会使 DeepSeek 保持在低成本供应商的定位。若是当前价格的数倍,则会重新开启购买决定,而 DeepSeek 的 V4-Flash 经济学此前似乎在几天前刚刚决定了这些购买选择。