Anthropic、オープンウェイト禁止に反対しつつフロンティアモデルの試験を支持

Dario Amodeiは、Anthropicがワシントンに採用してほしいと望んでいるチップ規制、反蒸留ルール、能力テストからオープンアクセスを切り離している。

By · Published

Primary source: Anthropic

Why it matters

Amodei is trying to keep Anthropic's safety agenda from being recast as protectionism. The resulting distinction could shape whether US rules target open models broadly or apply capability tests to every frontier lab.

Anthropic rejects an open-weights ban while backing tests for frontier models — Dario Amodei is separating open access from the chip controls, anti-distillation rules and capability tests Anthropic wants Washington to adopt.

Dario Amodeiは7月27日のAnthropic policy postを用いて、オープンウェイトAIモデルの全面禁止を求める声を退ける一方で、フロンティアを形作るチップ、トレーニング手法、高リスク能力に対するより厳格な規制を擁護した。

AnthropicがXで

「Anthropicはオープンウェイトモデルの禁止を訴えたことは一度もない」とAmodeiは書いた。彼は危険な能力を持たないモデルを開発者、研究者、企業にとって「公共財(public good)」と呼び、米国企業によるそれらの利用制限は彼が懸念する国家安全保障上の脅威に対処することにはならないだろうと述べた。

この声明により、Amodei自身がAnthropicの安全性アジェンダを商業的な防御戦略として位置づけるという政策論争の中心に据えられることになった。Google Brainで働き、その後OpenAIの研究担当副社長となりAnthropicを共同設立した物理学者かつ生物物理学者であるAmodeiは、安全性のコントロールはモデルの能力と並行して進歩しなければならないという前提をもとにAnthropicを構築してきた。彼の7月27日の投稿はその前提に関してより厳しい境界線を引いている:配布形式だけでどのモデルに制限を課すかを決めるべきではない、ということだ。

「それは米国のAI企業を競争から守ることになるだろうが、私の目的がそれだったことは一度もない」とAmodeiは米国企業による利用を標的にした禁止について書いた。この譲歩は重要だ。なぜならAnthropicはクローズドなフロンティアモデルへのアクセスを販売しており、政策立案者がダウンロード可能な競合モデルをどのように扱うかに対して直接的な金銭的利害を持っているからである。

保護主義の非難がより明確な回答を促す

この声明はワシントンとテクノロジー業界からの一週間にわたる圧力に続くものだった。Axiosは7月20日に報じたところによれば、米国当局は中国製のオープンウェイトモデルを米国企業が使用することを思いとどまらせたり阻止したりする可能性のある措置を検討していた。ホワイトハウスのAI顧問であるDavid Sacksは、主要なクローズドモデル開発者がより安価な競合相手から政府の保護を求めていると非難した。

7月24日、多くのテック企業がオープンウェイトを支持する業界書簡を公開した。署名者たちは、ダウンロード可能なモデルはアクセスを拡大し、限定された少数のプロバイダーへの依存を減らし、顧客が自前のインフラでAIを実行できるようにすると主張した。また、政策立案者に対して正当なモデル蒸留(model distillation)を不正流用と見なすことへの警告も行った。

Anthropicは代わりに独自の回答を発表した。Amodeiはオープンウェイトがアクセスを広げ、顧客のコントロールを改善し、ある市場では競争を強化し得ることに同意した。一方で、オープンであることが多くの防御者や研究者にモデルへのアクセスを与えることで必ずしも安全性を向上させるという書簡のより広い主張は否定した。

その不一致はオープンウェイト議論の最も難しい部分に達している。モデル所有者はホスティングされたシステムの保護対策を更新したり、使用を監視したり、アクセスを取り消したりすることができる。いったんウェイトが公開されると、改変されたコピーは元の開発者の管理を超えて広まる可能性がある。Amodeiは、リスクはオープンかクローズドかというラベルから推定するのではなく、能力テストを通じて測定されるべきだと主張している。

Amodeiは能力と計算資源を標的にした政策を求める

Amodeiは三つの優先事項を示した。米国は中国への先進的チップおよび半導体製造装置の輸出と密輸を制限すべきであり、米国モデルからの能力の産業規模での抽出を抑止し、十分に高い能力を持つモデルについてはウェイトがオープンであれクローズドであれ、公開前に安全性テストを通過することを要求すべきだとした。

反蒸留の主張はAnthropicの蒸留攻撃の検知と防止に関する報告に続くものだ。Amodeiは産業規模のキャンペーンと、より強力なシステムの出力を用いてより小さなモデルを訓練する一般的な手法である通常の蒸留を区別している。彼が懸念しているのはスケール、不正なアクセス、そしてフロンティア能力が米国の管理外で活動する研究所へ移転することだ。彼の定式化では、政策の対象はウェイト公開の後の決定ではなく能力の抽出そのものである。

また彼は、モデルが能力の閾値を超えた場合にはサイバー、生命科学、アライメントリスクに対する強制的なテストを支持した。Amodeiは、出自の国や公開形式にかかわらず最も高い能力を持つシステムに対してテストを適用し、能力の低いモデルを免除するという点で、Demis Hassabisの提案を一つの業界モデルとして指摘した。

その閾値が、システムが最大規模の研究所のみを抑制するか、新興の競合相手にとって費用負担の大きな障壁となるかを決めることになる。したがって閾値設定が核心の争点となる:スタートアップや学術機関を閉じ込めない程度に狭く、しかし深刻なサイバー、生命科学、またはアライメント上のリスクを呈するモデルをカバーするのに十分に広いことが求められる。

Anthropicの商業的立場が賭けを高める

Anthropicの政策への影響力は財務状況とともに高まっている。5月28日、AnthropicはAltimeter Capital、Dragoneer、Greenoaks、Sequoia Capitalが主導する$65 billion Series Hを$965 billionのポストマネー評価で調達したと発表した。Anthropicはまたその月初めにランレート収益が$47 billionを超えたと述べた。RuntimeWireは以前、Amodeiのラウンドが2026年のスタートアップ資金市場を集中させた方法を調査している。

これらの数字は保護主義の批判を避けられないものにしている。Anthropicは小規模な開発者に負担を強いるようなコンプライアンスコストを吸収できるだけの資本、計算リソースの確約、顧客基盤を持っている。クローズドアクセスはまた、Anthropicが使用料を請求し、アカウントレベルでポリシーを強制することを可能にする。

AmodeiはAnthropicが結果に利害関係を持たないと主張する代わりに、その緊張を直接扱った。彼の立場は、商業および研究用途の大部分においてオープンウェイトモデルの余地を残しつつ、深刻なサイバーまたは生命科学上の害を与え得るモデルの周辺に対する規制を求めるものだ。またそれは、開発者がウェイトを公開するつもりであっても、フロンティア開発には監督が必要だというAnthropicの従来からの主張を維持する。

Anthropicは依然としてClaudeのフロンティアウェイトをクローズドにしており、7月27日の声明はAnthropicをオープンリリースにコミットさせるものではない。しかしそれは政策論争を狭める。Amodeiはワシントンに対し、ダウンロード可能なあらゆるモデルを同一の安全保障問題として扱うのではなく、測定可能な能力、計算アクセス、悪用的な抽出を規制するよう求めている。

Reader comments

Conversation for this story loads after sign-in.