Anthropic 拒绝对开放权重的禁令,同时支持对前沿模型进行测试

Dario Amodei 正在将开放访问与 Anthropic 希望华盛顿采纳的芯片控制、反蒸馏规则和能力测试区分开来。

By · Published

Primary source: Anthropic

Why it matters

Amodei is trying to keep Anthropic's safety agenda from being recast as protectionism. The resulting distinction could shape whether US rules target open models broadly or apply capability tests to every frontier lab.

Anthropic rejects an open-weights ban while backing tests for frontier models — Dario Amodei is separating open access from the chip controls, anti-distillation rules and capability tests Anthropic wants Washington to adopt.

Dario Amodei 用一篇 7 月 27 日的 Anthropic 政策声明 来拒绝对开放权重 AI 模型实行全面禁止的呼声,同时为对塑造前沿的芯片、训练方法和高风险能力实施更严格的管控辩护。

Anthropic 在 X

“Anthropic 从未主张禁止开放权重的模型,”Amodei 写道。他称不具危险能力的模型对开发者、研究人员和企业来说是“公共产品”,并表示对美国公司使用这些模型施加限制无法解决令他担忧的国家安全威胁。

该声明将 Amodei 本人置于一场政策争论的中心,这场争论已开始将 Anthropic 的安全议程视为一种商业防御策略。Amodei 是一位曾在 Google Brain 工作并在联合创立 Anthropic 之前担任 OpenAI 研究副总裁的物理学家与生物物理学家,他围绕“安全控制必须与模型能力同步推进”这一前提出建构 Anthropic。他 7 月 27 日的帖子在这一前提上划出更明确的界限:仅凭分发格式不应决定哪些模型面临限制。

保护主义指控迫使其给出更明确的回应

该声明是在华盛顿和科技行业一周压力之后发布的。Axios 在 7 月 20 日报道 称美国官员曾考虑采取可能劝阻或阻止美国公司使用中国开放权重模型的措施。白宫 AI 顾问 David Sacks 指责领先的封闭模型开发者在寻求政府对更廉价竞争者的保护。

7 月 24 日,许多科技公司发表了一封 支持开放权重的行业信函。签署公司认为可下载模型能扩大访问、减少对少数供应商的依赖,并让客户在自己的基础设施上运行 AI。信中还警告政策制定者不要将合法的模型蒸馏行为视为不当挪用。

Anthropic 发布了自己的回应。Amodei 同意开放权重在某些市场上可以扩大访问、提高客户控制并增强竞争。他拒绝了该信函更广泛的主张,即开放性必然通过让更多防御者和研究人员接触模型来提高安全性。

这种分歧触及开放权重争论中最难的部分。模型所有者可以更新防护措施、监控使用或撤销对托管系统的访问。一旦权重被发布,被修改的副本可以在原开发者的控制之外传播。Amodei 认为这些风险应通过能力测试来衡量,而不是从开放或封闭的标签中推断。

Amodei 希望政策针对能力与算力

Amodei 提出了三项优先事项。美国应限制向中国出口和走私高端芯片及芯片制造设备,遏制对美国模型的工业规模能力提取,并要求足够具备能力的模型在发布前通过安全测试,无论其权重是开放还是封闭。

反蒸馏条款遵循了 Anthropic 关于检测和防止蒸馏攻击的报告。Amodei 将工业化活动与普通蒸馏区分开来,后者是用更强系统的输出训练更小模型的一种常见方法。他关心的是规模、未经授权的访问以及将前沿能力转移到运行在美国监管之外的实验室。他提出的政策目标是能力提取,而不是随后发表权重的决定。

他还支持一旦模型越过某个能力阈值就对网络、生物和对齐风险进行强制测试。Amodei 指向了 Demis Hassabis 的一项提议,将其作为一个可能的行业模式,用以对最具能力的系统实施测试(无论其来源国或发布形式),同时对能力较低的模型予以豁免。

阈值将决定该制度是仅约束最大的实验室,还是成为对新兴竞争者的昂贵门槛。这使得设定阈值成为核心斗争:既要足够狭窄以避免困住初创公司和学术界,又要足够宽泛以覆盖可能带来严重网络、生物或对齐风险的模型。

Anthropic 的商业立场提高了赌注

Anthropic 的政策影响力随着其资产负债表增长而扩大。5 月 28 日,Anthropic 表示其通过 Altimeter Capital、Dragoneer、Greenoaks 和 Sequoia Capital 领投,完成了一轮 $65 billion Series H,事后估值为 $965 billion。Anthropic 还表示当月早些时候的运行率收入已突破 $47 billion。RuntimeWire 早前曾审视过 Amodei 的这一轮如何集中 2026 年初创公司融资市场

这些数字使得保护主义的批评不可避免。Anthropic 具备吸收将使较小开发者承压的合规成本的资本、算力承诺和客户基础。封闭访问也让 Anthropic 能够按使用计费并在账户层面强制执行其政策。

Amodei 直接应对了这一紧张关系,而不是声称 Anthropic 在结果上没有利害关系。他的立场在大多数商业和研究用途上为开放权重模型留下空间,同时寻求对可能造成严重网络或生物伤害的模型实施控制。这也保留了 Anthropic 长期的论点:即使开发者计划公开发布权重,前沿开发也需要监管。

Anthropic 仍然将 Claude 的前沿权重保持封闭,7 月 27 日的声明并未承诺 Anthropic 会公开发布权重。该声明确实缩窄了政策论点。Amodei 正在要求华盛顿对可衡量的能力、算力访问和滥用式提取进行监管,而不是将每一个可下载模型都视为同样的安全问题。

Reader comments

Conversation for this story loads after sign-in.