Anthropicの不可視のClaudeウォーターマークが、クローズドな検出を巡り精査を招く
Anthropicは後に第三者による検出を約束しているが、初期の展開は同社がまだ公開していない技術的詳細に依存することになる。
By RuntimeWire Staff · Published
Primary source: X
Why it matters
Closed detection gives Anthropic outsized control over whether writing is labeled as Claude-processed, while the mark can attach to human-authored text sent through Claude for editing.

AnthropicのClaude生成テキストに目に見えないウォーターマークを埋め込む計画は、水曜日にベテラン投資家のBill Gurley (@bgurley)からの批判を受けた。Gurleyは、Anthropicがマーク付けシステムとその出力を識別する手段の両方を支配することになると主張した。
「This is only identifiable by Anthropic(これはAnthropicによってのみ識別可能だ)」とGurleyは8月12日に書いた。「またしても彼らが裁判官であり陪審であり検察官だ。」彼は元Microsoft Windows責任者で現Andreessen Horowitzの取締役パートナーであるSteven Sinofsky (@stevesi)への応答として述べた。
GurleyはBenchmarkで何十年も活動し、同社の代表的な投資の一つであるUberへの投資を行った。ベンチャーキャピタルに入る前はCompaqの設計エンジニアとして働き、ウォール街のアナリストとしてパーソナルコンピュータ企業をカバーし、Amazonの新規株式公開(IPO)の主担当アナリストを務めたこともある。彼の批判は、開発者、出版社、そしてClaudeを使って資料を作成または編集する企業に直接影響を及ぼす技術的実装に集中している。
Anthropicが展開しているもの
AnthropicはEUのAI法への対応の一環として、8月11日にマーク付けシステムを文書化した。Anthropicによれば、Claudeモデルは8月2日以降にローンチされたものが発売時点でマーク付けをサポートする。それ以前にリリースされたモデルには移行期間が適用され、Anthropicはそれらへの対応追加に取り組んでいるという。
この区別は、現行のすべてのClaudeの応答がすでにウォーターマークを含んでいるという主張がAnthropicの文書を超えていることを意味する。システムはサポート対象モデルの出力に適用される。
テキストについては、Anthropicはモデルが生成された言語に人間には感知できないマークを織り込むと説明している。そのマークはテキストがコピー&ペーストされた場合に残り、ある程度の編集を経ても残存する可能性がある。Anthropicはこの仕組みがClaude、Claude Code、Claude Cowork、Claude Tag、およびClaude APIのモデルレベルで動作し、AWS、Google Cloud、Microsoft Foundryを通じてアクセスされるサポート対象モデルを含むと述べている。Anthropicはこのシステムを世界中で適用する計画だ。
ファイルは別の種類のマークを受け取る。サポート対象のSVG、PNG、JPGファイルには、オープンな業界標準であるC2PAに基づいた署名付きのプロベナンス(出所)メタデータが付与される。該当するメタデータは、Claudeがファイルを処理したかどうか、およびその後に変更が加えられたかどうかを示すことができる。
Anthropicはテキストにウォーターマークを入れる際の技術的手法を公表しておらず、一般向けの検出ツールも公開していない。ドキュメントには、ユーザーや第三者向けのツールが後日提供されると記されている。それにより、テキストマークがどのように機能し、どの程度確実に検出できるかを説明できる初期の権威はAnthropicに限られるという、Gurleyが指摘したコントロール上の問題が残る。
マークは著作者を立証しない
Anthropic自身の制約は、最終的な検出器が証明できる範囲を狭める。検出されたマークはコンテンツがClaudeによって処理された可能性を示すにすぎない。マークはClaudeが元の資料を執筆したことを立証するものではない。
人が文書を書き、それを校正、翻訳、またはフォーマット調整のためにClaudeに通し、マークの付いたテキストを受け取ることはあり得る。マークされた箇所は編集されたり、抜粋されたり、人的な文章と結合されたりすることもある。これにより、「Claudeがこのテキストを処理した」と「Claudeがこのテキストを作成した」という間に実質的な区別が生じる。特に学校、職場、出版社のシステムでは、検出結果をAIポリシーの施行に利用する可能性があるため重要だ。
逆も同様に重要である。Anthropicは、マークがないことは人間による著作を証明しないと述べている。テキストが短い、激しく編集されている、言い換えられている、翻訳されている、または他の素材と混合されている場合、検出は失敗する可能性がある。古いモデルやサポート対象外のモデルの出力もシグナルを欠くことがある。
欧州連合の第50条は、生成AIシステムの提供者に対し、合成テキスト、音声、画像、映像を機械読取可能かつ人工的に生成または操作されたものであると検出可能にすることを要求している。義務は8月2日に発効し、市場にすでに出ているシステムには12月2日までの移行期間が与えられた。欧州委員会の透明性コードは、マーク付けと検出方法が効果的で、相互運用可能で、信頼でき、技術的に可能な限り堅牢であることを求めている。
Anthropicは、この任意のコードに署名することで、拘束力のあるAI法要件への準拠を示すルートをとった。マークを世界中で展開する決断は、ヨーロッパ向けに別個のモデル挙動を維持しないことを意味するが、その一方でEU主導の準拠システムを米国や他の市場のClaudeユーザーにも拡張することにもなる。
Gurleyの批判は、外部のユーザーが中心的な主張——検出精度、偽陽性率、編集への耐性、出力品質への影響——をテストする前に表明された。AnthropicはウォーターマークがClaudeの意味、品質、可読性を変えないと述べているが、その主張を独立して検証するために必要な技術文書は未公表のままである。