Brian RoemmeleがClaudeのテキスト透かしを除去するMac用クリーナーをリリース

ローカルのワークフローはマークされたテキストを書き換えますが、Anthropicはそのクリーナーを独立して検証するために必要な検出器を公開していません。

By · Published

Primary source: X

Why it matters

Anthropic is applying EU-driven marks to Claude output worldwide. Roemmele's cleaner shows how quickly developers will challenge those signals, raising questions about reliability, attribution and compliance.

Illustration of Brian Roemmele's Mac cleaner inspecting a document page with faint, repeating text patterns suggesting Claude's text watermarks.

Brian Roemmele (@BrianRoemmele)、テクノロジー調査サイト ReadMultiplex の創設者は、8月12日に Mac 専用のツールとローカルでの書き換えワークフローを公開し、Anthropic が Claude 生成テキストに埋め込んでいる新しい機械判読可能なウォーターマークを除去できると述べた。

Brian Roemmele launches Mac cleaner for Claude's text watermarks — The local workflow rewrites marked text, but Anthropic has not published the detector needed to independently verify the cleaner.

Roemmele はそれをXへの投稿で紹介し、Anthropic のマークをオープンウェブ上のトレーニングから生成された素材に付随する隠れた指紋と表現した。彼が併記したReadMultiplex の記事では、そのソフトウェアを AI Watermarks Cleaner と呼び、ローカルで言語モデルを実行する LM Studio と組み合わせていると説明している。

そのワークフローは、メタデータや不可視の Unicode 文字を単純に削除するのではなく、ローカルでの書き換えに依存しているように見える。Roemmele はこのプロセスが、生成された言語に埋め込まれた統計的パターンと可視的なフォーマット信号を分離し、その後ローカルモデルを使って素材を書き換えると説明している。今回のリリースは Mac 専用で、Windows と Linux 版が計画されているとし、説明書とダウンロードは ReadMultiplex の有料会員を通じて提供されている。

この発表は、Anthropic が公開した情報に続くものだ。Anthropic は、2026年8月2日以降に欧州連合で導入される Claude モデルは起動時に生成されたテキストにマークを付けると明言している。Anthropic によれば、同じマークは Claude、Claude Code、Claude Cowork、Claude Tag、Claude API を通じて利用されるサポートモデル間で、Amazon Web Services、Google Cloud、Microsoft Foundry 経由のアクセスを含め世界中に伝播するとしている。

Anthropic は2つのシステムを使用している。テキストには生成時に適用される「知覚できない」ウォーターマークが付与され、一方で PNG、JPG、SVG のようなサポートされるファイルには C2PA 標準に基づく署名付きプロベナンス(出所)メタデータが付与される。Anthropic は、テキスト信号はモデルレベルで生成言語に織り込まれているため、コピー&ペーストや一部の編集を経ても生き残る可能性があると説明している。

その説明は同時に Roemmele のクリーナーの中心的な限界も定義している。Anthropic はテキストマークの技術仕様や公開検出器をまだ公開していない。あるツールは Claude の出力を書き換えてウォーターマークを弱める可能性があるが、マークが処理前後で独立して検出可能になるまで、その成功は Anthropic の実装に対して測定できない。

Anthropic 自身も、強い編集、言い換え、翻訳、あるいは一つの文章を他の文と組み合わせることでマークが検出不能になる可能性があることを認めている。短い文章は信頼できる信号を生成するのに十分な情報を含まない場合がある。ファイルのプロベナンスも、誰かがファイルを変換または再保存したり、スクリーンショットで取り込んだりすると消失することがある。

したがって Roemmele のローカルでの書き換えアプローチは、Anthropic 自身が文書化している弱点を狙ったものだ:コンテンツが人間や機械の編集を経るにつれてプロベナンス信号は信頼性を失う。実際の問題は、クリーナーがどの程度まで文章を変更するのか、そして統計的信号を破壊しつつ事実、引用、著者の意図をどれだけ保持するのかという点である。ReadMultiplex は Anthropic の検出器に対する独立して再現可能な結果を提示していない。

ウォーターマークはユーザー識別子ではない

Roemmele は、これらのマークをユーザーやプロンプトに遡って AI 出力を追跡できる指紋と表現し、Anthropic の公開文書より一歩踏み込んだ主張をしている。Anthropic は計画中の検出器がその資料が Claude によって処理された可能性を示すと述べている。彼らは陽性結果が元の著者やコンテンツの完全な履歴を確定するものではないと明確に警告している。

ある文書が Claude のマークを持つのは、モデルが単に人間の書いた素材を校正、翻訳、要約、あるいは再フォーマットしただけであってもあり得る。これは出版社、開発者、そして生産システム内で Claude を利用する企業にとって意味のある帰属問題を生む:機械判読可能なラベルは Claude の関与を正しく検出しても、読者に基礎となる作品の誰が作成したかについて誤った印象を与える可能性がある。

この方針はEU AI Act の第50条に由来するもので、生成システムの提供者に対し合成されたテキスト、音声、画像、動画の出力を機械判読可能かつ AI 生成または操作されたものとして検出可能にすることを要求している。法律はウォーターマーク、メタデータ、暗号学的プロベナンス、指紋を可能な方法として挙げている。また、通常の編集を行うシステムやユーザーの入力やその意味を実質的に変えない変更を行うシステムは免除される。

Anthropic はヨーロッパ専用の出力動作を維持する代わりに、マーク付けシステムを世界中に適用することを選んだ。その決定により、ヨーロッパの透明性規則は米国の Claude ユーザーや API 顧客にも直接的な影響を及ぼすことになる。

Roemmele のリリースは、Anthropic がシステムの文書化を完了する前にコンプライアンスの次の段階を開いた。AI 提供者は通常の編集を経ても残るマークを必要としており、顧客は商業的、プライバシー的、編集上の理由から自分たちの作品に残るものを制御したいと考えている。ローカルでの書き換えツールは、テキストウォーターマークが両者を満たし得るか、あるいはプロベナンスシステムとその信号を消去するよう設計されたソフトウェアとの間で継続的な対立が生じるかを試すことになる。

Reader comments

Conversation for this story loads after sign-in.