Anthropicは、ClaudeがHAWKおよびラウンド数を減らしたAESに対する攻撃を改良したと述べた
7月28日の開示によると、Claude Mythos PreviewはNISTのポスト量子署名候補およびラウンド数を減らしたAES変種に対する攻撃を改善し、本番環境への影響は報告されていない。
By Ryan Merket · Published
Primary source: Anthropic
Why it matters
Claude has moved from finding implementation bugs to proposing attacks on cryptographic designs. Founders, security teams and infrastructure operators need expert validation, responsible-disclosure procedures and model-access controls before similar methods target deployed systems.

Anthropic, co-founded by Dario Amodei and Daniela Amodei, said on July 28 that its controlled-access Claude Mythos Preview model helped researchers improve the best-known attack on HAWK, a post-quantum signature candidate that advanced to the third round of a US government standardization process in May. Anthropic says the work effectively cut HAWK's key strength in half.
編集部注: この記事はAnthropicが開示したHAWKおよび短ラウンドAESに関する発見とそれらの公開プロセスを扱っている。別のRuntimeWire記事は評価データセットとしてのCryptanalysisBenchを取り上げている。
この開示は、Anthropicが掲げるセキュリティ戦略の背後にある取引の具体的な試験をAmodei夫妻にもたらす。深刻なソフトウェア欠陥を見つけられるのと同じモデル能力は、デジタル通信を保護する数学的手法も探ることができる。創業者やセキュリティ責任者にとって、この研究はサイバー能力を持つモデルを誰が利用できるか、発見をどのように検証すべきか、いつ攻撃手法を公開すべきかといった実務的な疑問を提起する。
Daniela Amodeiは、Anthropicの出発点を「初日から安全にAIシステムを構築すること」に置いたと述べている。Dario Amodeiはプリンストンで学んだ生物物理学者で、以前はOpenAIで研究を率い、Google Brainにも在籍していた。彼は能力の向上とリスク対策を同時に開発していくという見方でAnthropicを築いてきた。暗号解析はその緊張を異例に明白にする。成功する攻撃は、暗号設計の弱点を展開前に棄却するのに役立つ一方で、同じ能力が既に運用されているシステムに対して危険になり得る。
Anthropicの研究記事は二つの主要な結果を説明している。Anthropicによれば、Mythosは約60時間の作業でHAWKに対する既知の最良攻撃を改善した。別の実行では、既存の攻撃に対して短ラウンドのAESを200〜800倍速くする方法が見つかった。Anthropicは各結果がAPI利用で約$100,000を消費したと見積もっている。
Anthropicによれば、いずれの発見もオペレーターにソフトウェアの置き換えや鍵のローテーションを要求するものではない。HAWKは標準として導入されておらず、AESの作業は弱められた研究用の変種を対象としている。完全なAESは影響を受けていない。
ClaudeがHAWKの対称性を見つけた
HAWKは、ポスト量子安全性を目指した格子(lattice)ベースのデジタル署名スキームである。
NISTは5月14日にHAWKを他の8候補とともに第3ラウンドに進めたが、HAWKは候補として公開審査中であり、NISTの標準として導入されているわけではない。
Anthropicは、MythosがHAWKの基盤となる格子において利用可能な対称性、すなわち非自明な自己同型(nontrivial automorphism)を発見したと述べている。以前の研究は、そのような自己同型を効率的に見つけられれば攻撃が可能になることを示していた。MythosはHAWKに適用可能な自己同型を特定し、Anthropicはこの結果を実質的にスキームの鍵強度を半分にしたと表現している。
この発見は、ブラウザ、アイデンティティシステム、ハードウェアベンダー、クラウドサービスが標準に基づいて構築する前に弱点を露呈させることを目的とした公開審査プロセスの間に到着した。
Anthropicはこの攻撃を6月にHAWKの著者と共有し、学術界に照会し、公開前に米国政府および業界パートナーに事前配布を行ったと述べている。
AESの結果は綿密に精査された暗号を試験する
二つ目の結果は、完全な暗号を実運用で使用するのではなく、短ラウンド版のAESに関するものである。研究者は、完全設計を保護するセキュリティ・マージンを調べたり、後の研究に役立つ手法を試験するために短ラウンド暗号を研究する。
Anthropicによれば、Mythosは既存の攻撃が要求していた一つの推測を排除し、以前の手法に比べて200〜800倍の計算上の高速化をもたらしたと算出された。Anthropicはこの結果が短ラウンドの研究変種にのみ適用され、完全なAESを破るものではないと明確に述べている。
Anthropicの開示によれば、Mythosは限られた人間の介入でHAWKとAESの作業の大部分を自律的に完遂した。Anthropicは学術的な照会と責任ある開示手続きを通じて発見を検証し公開した。このプロセスは、AI支援のセキュリティ研究における遅い部分、すなわち専門家によるレビュー、新規性の確認、そしていつどのように信頼できる攻撃を公開するかの判断に圧力をかける。
RuntimeWireは7月初めに、Mythos主導の脆弱性開示が既にパッチ適用のボトルネックを露呈していると報じた。アルゴリズム研究は、クラッシュレポートや概念実証エクスプロイトを超える専門的な検証を要求する点で異なる検証問題を提起する可能性がある。
Anthropicはこの作業を制御されたアクセスに結びつける
Anthropicが4月7日にMythos Previewを紹介した際、同社はこのモデルがテストしたソフトウェアの脆弱性を自律的に発見・悪用でき、いくつかの主要な暗号ライブラリを含むと述べていた。これらの主張はソフトウェアの実装ミスに関するものだった。HAWKとAESの作業は、モデルの報告された能力を暗号設計の弱点にまで拡張するものだ。
Anthropicは当初、Mythos Previewを重要ソフトウェアの保護を目的としたイニシアティブであるProject Glasswingの一環として位置づけていた。暗号に関する開示は、Anthropicがサイバーモデルに対して制御されたアクセスを強調している理由を示している:研究能力は専門家によるレビューと管理された公開プロセスを必要とする攻撃手法を生む可能性があるからだ。
Amodeisのセキュリティ論は現在アルゴリズムレベルの試験に直面している。当面の運用上の影響は限定的だが、創業者やセキュリティ責任者は、同様の手法が実運用トラフィックを扱う暗号に到達する前に、モデル生成の攻撃をどのように検証・制限・責任を持って開示するかを決定しなければならない。標準化の過程で弱い設計を特定するモデルは、ベンダーが高コストな導入を避けるのに役立つ可能性がある。最終的に提案された攻撃が信頼できるかどうかを判断するのは依然として専門家のレビューである。