在人工智能模型商品化加速之际,Anthropic 将 Sonnet 5 定价保持低廉

被取消的涨幅把一项促销变成了对代理工作负载的争夺,因为模型竞争正转向运营成本。

By · Published · Updated

Primary source: Claude

Why it matters

Anthropic is using permanent lower pricing to win production agent workloads before integrations harden, trading some token revenue for distribution and recurring API demand.

Illustration of Anthropic's Sonnet 5 as a central stable data conduit with dynamic light trails circling it to represent data flow and competitive pressure.

Dario Amodei (@DarioAmodei) and Daniela Amodei's Anthropic made Claude Sonnet 5's introductory API pricing permanent on August 10th, canceling an increase scheduled for September 1st. Claude's official account said on X that the model will remain at $2 per million input tokens and $10 per million output tokens.

Anthropic 原计划在 8 月 31 日之后对输入收费 $3、对输出收费 $15。将发布价维持为长期定价把这两个数字都从原计划价格下调了三分之一,并把为期两个月的促销转变为该模型的长期成本结构。

这一逆转再次表明,先进 AI 模型的销售越来越依赖价格和运营经济学,而不仅仅是能力本身。Sonnet 5 仍不能被视为与竞争模型完全可互换,但 Anthropic 正将其定价为面向生产软件的大量输入来源,而不是稀缺的高端溢价产品。

这一区别对构建 agent 的创始人很重要。随着竞争系统在相同工作流上达到性能门槛,模型变得更难区分,采购决策随之转向已完成任务的成本、可靠性和集成开销。Anthropic 的决定在开发者必须将这些工作负载转移到别处之前,移除了一个已排定的涨价因素。

Commoditization reaches agent economics

Anthropic launched Claude Sonnet 5 on June 30th as its most agentic Sonnet model, built to plan, operate browsers and terminals, use tools and complete multi-step work. Anthropic says Sonnet 5 approaches the performance of the more expensive Opus 4.8 on some tasks, although those comparisons come from Anthropic's own evaluations and do not establish equivalent performance across customer workloads.

永久价格之所以重要,是因为 agent 应用与简单聊天产品相比对 tokens 的消耗方式不同。一个 agent 可能会反复检查文件、读取工具结果、修订计划并生成代码,才能完成一次用户请求。每个循环都会增加输入和输出 tokens,因此看起来在提示级别上温和的涨价,会在自治工作流中成倍放大。

考虑一个示例性的月度工作负载:使用 10 亿 输入 tokens 和 2 亿 输出 tokens。以永久价格计算,Sonnet 5 的费用为 $4,000。先前计划的费率会产生 $6,000 的账单。$2,000 的差额可以用于更多运行、更长的上下文或更多的评估流量,而无需改变应用架构。

永久定价也改变了初创公司制定计划的方式。促销价鼓励试验,但也给团队设定了一个期限,必须决定模型是否能支持可接受的毛利率。取消 9 月 1 日的涨价让开发者能够在 Anthropic 已公开承诺维持的价格下评估 Sonnet 5,而不是围绕暂时补贴来构建。

这就是商品化在实践中的表现:并非证明每个模型性能相同,而是对供应商施加压力,要求他们让有能力的模型更便宜、更易于采用。一旦多个系统能合理处理某项工作负载,token 价格和总运营成本就会对购买决策变得更为重要。

Anthropic prices for the execution layer

这一经济学指向一种采纳策略。一旦开发者围绕某个模型构建了提示、评估、工具 schema、安全控制和可观测性,切换供应商就成了一个工程项目。更低的费率给了 Anthropic 在生产集成固定之前赢得工作负载的另一种方式。

Sonnet 5 的标价压低了 OpenAI 目前的平衡模型 GPT-5.6 Terra 的价格,后者 OpenAI 列为每百万输入 tokens $2.50, 每百万输出 tokens $15。按照这些公布的费率,Sonnet 5 在输入上便宜约 20%,在输出上便宜约三分之一。模型并非可互换,企业合约也可能有谈判价格,但这一比较为开发者在成本与质量评估中纳入 Sonnet 5 提供了理由。

对于需要生成大量产物的编码 agent 和其他系统,输出定价尤为重要。Anthropic 的 $10 费率在输出费用上与 Terra 的 $15 形成了比仅看输入更大的差距。运营成本仍取决于每个模型完成任务所需的尝试次数、执行多少推理以及多频繁调用外部工具。

Anthropic 拥有承受 token 利润率压力的资产负债表。公司表示 在 5 月 28 日以 9,650 亿美元的投后估值完成了 650 亿美元的融资,由 Altimeter Capital、Dragoneer、Greenoaks 和 Sequoia 领投 Series H。Anthropic 还表示其年化收入在当月早些时候已超过 470 亿美元。这些数据来自公司自身披露,其并未公布按模型划分的利润率或按公布价产生的营收比例。

这笔融资让 Amodei 夫妇在计算和分发上有更大空间投入,同时保持高流量模型的低价位。它也提高了商业赌注。以该估值支持 Anthropic 的投资者需要 Claude 成为企业软件中的持久一层,而不是客户每个季度试用后替换的模型。将 Sonnet 的发布价设为永久价格,通过在客户谈判更大承诺之前降低采用成本,支持了这一目标。

Token prices do not settle the comparison

开发者仍应以已完成任务的成本来测试 Sonnet 5,而不是简单地用旧的 token 数乘以新费率。Anthropic 表示 Sonnet 5 使用了更新的分词器(tokenizer),相同的输入根据内容可能产生大约 1 到 1.35 倍的 tokens。因此名义上的价格降低并不直接等同于从较旧 Claude 模型迁移时相同百分比的节省。

Agent 的努力设置进一步使比较复杂化。更高的努力可以提升性能,但也会增加 token 消耗。一个更便宜的模型如果运行时间更长、重试更多次或生成不必要的输出,按每次成功任务计算的成本可能比标价更高的模型还要高。评估 Sonnet 5 的团队需要在 token 花费之外衡量成功率、工具调用、延迟和人工审查。

Anthropic 的决定从这一计算中移除了一个不确定因素。原定的涨价会迫使客户在承受促销美元数字 50% 的跃升、重新设计工作负载或更换供应商之间做出选择。维持 $2 和 $10 的费率让 Anthropic 在模型市场的中间地带拥有更强的主张——该地带要求能力足够支持自治工作,同时又足够便宜以重复运行。

前沿实验室可以把最昂贵的模型保留给那些最大能力决定结果的工作负载,同时使用更便宜的模型来承接大量常规的 agent 执行。Anthropic 赌注是 Sonnet 5 能掌握更多那部分执行层。通过将其发布价设为永久价格,公司承认即便是先进的 AI 能力,在客户拥有可信替代方案后也面临商品化压力。

Reader comments

Conversation for this story loads after sign-in.