Anthropic 表示 Claude 改进了针对 HAWK 和轮数减少的 AES 的攻击

7月28日的披露称,Claude Mythos Preview 改进了对 NIST 的一种后量子签名候选方案和一种减轮 AES 变体的攻击,但未报告对生产环境造成影响。

By · Published

Primary source: Anthropic

Why it matters

Claude has moved from finding implementation bugs to proposing attacks on cryptographic designs. Founders, security teams and infrastructure operators need expert validation, responsible-disclosure procedures and model-access controls before similar methods target deployed systems.

Illustration of Anthropic's Claude Mythos Preview probing a cracked lock labeled HAWK and AES, revealing a cryptographic vulnerability.

Anthropic, 由 Dario AmodeiDaniela Amodei 共同创立,7月28日表示其受控访问的 Claude Mythos Preview 模型帮助研究人员改进了对 HAWK 的已知最佳攻击。HAWK 是一种后量子签名候选算法,于5月进入美国政府标准化流程的第三轮。Anthropic 表示这项工作实际上将 HAWK 的密钥强度削弱了一半。

编者注:本文涵盖 Anthropic 公开的 HAWK 和简化轮次 AES 发现及其发布流程;另外一篇 RuntimeWire 报道涵盖 CryptanalysisBench 作为评估数据集。

这次披露为 Amodeis 提供了对 Anthropic 安全策略背后权衡的一个具体检验。能够发现严重软件缺陷的同等模型能力,也可以探测保护数字通信的数学基础。对于创始人和安全负责人而言,这项研究提出了关于谁可以使用具备网络能力的模型、如何验证其发现以及何时应公开攻击方法的一些实际问题。

Daniela Amodei 曾描述 Anthropic 的起源是围绕“从第一天起”安全地构建 AI 系统。Dario Amodei 是受过普林斯顿训练的生物物理学家,曾在 OpenAI 领导研究并在 Google Brain 工作,他围绕能力提升与风险控制必须同时发展的观点构建了 Anthropic。密码分析使这种紧张关系格外明显:一次成功的攻击能够帮助密码学家在部署前否定一个薄弱的设计,而同样的能力也可能对已在使用中的系统构成危险。

Anthropic 的 研究文稿 描述了两个主要结果。Anthropic 表示,Mythos 在大约60小时的工作后改进了对 HAWK 的已知最佳攻击。另一次运行发现了一种方法,使现有针对简化轮次 AES 的攻击速度提高了200到800倍。Anthropic 估计每个结果大约消耗了 100,000 美元的 API 使用费用。

Anthropic 表示,根据其评估,两个发现都不需要运营者更换软件或旋转密钥。HAWK 尚未作为标准部署,AES 的工作针对的是一个弱化的研究变体。完整的 AES 不受影响。

Claude 在 HAWK 中发现了一个对称性

HAWK 是一种基于格的数字签名方案,旨在提供后量子安全性。

NIST 在5月14日将 HAWK 与另外八个候选项一起推进,此前已进行两轮审查。HAWK 仍处于作为候选项的公开评审阶段,并非已部署的 NIST 标准。

Anthropic 表示,Mythos 在 HAWK 所基于的格结构中发现了可利用的对称性,称为非平凡自同构。此前的研究已表明,高效找到这种自同构将允许发动攻击。Mythos 识别出了一个适用于 HAWK 的自同构,Anthropic 因此将该结果描述为实际上将该方案的密钥强度减半

这一发现出现在公开评审过程中,旨在在浏览器、身份系统、硬件厂商和云服务围绕某一标准构建之前暴露其弱点。

Anthropic 表示已在6月与 HAWK 的作者共享了该攻击,咨询了学术界并在发布前向美国政府和行业合作伙伴提供了提前稿件。

AES 结果检验了一个受高度审视的分组密码

第二个结果涉及一个简化轮次的 AES,而生产系统使用的是完整的密码算法。研究人员研究简化轮次的密码以检验保护完整设计的安全裕度,并测试可能为后续工作提供信息的技术。

Anthropic 表示,Mythos 消除了现有攻击所需的一个猜测,从而在计算上使速度比以前的方法提高了200到800倍。Anthropic 明确指出,该结果仅适用于简化轮次的研究变体,并不破坏完整的 AES。

根据 Anthropic 的披露,Mythos 在有限的人类干预下自主完成了大部分 HAWK 和 AES 的工作。Anthropic 依靠学术咨询和负责任披露程序来验证并发布这些发现。该流程对 AI 辅助安全研究中较慢环节施加了压力:专家审查、新颖性检查以及关于何时以及如何发布可信攻击的决策。

RuntimeWire 在七月早些时候报道过 Mythos 驱动的漏洞披露已经暴露出补丁瓶颈问题。算法研究带来了不同的验证问题,因为数学论证可能需要超出崩溃报告或概念验证利用之外的专家审查。

Anthropic 将这项工作与受控访问联系起来

当 Anthropic 在4月7日推出 Mythos Preview 时,Anthropic 表示该模型可以自主发现并利用它测试的软件中的漏洞,包括若干主要的加密库。这些主张涉及的是软件中的实现错误。HAWK 和 AES 的工作将该模型报告的能力扩展到了加密设计层面的弱点。

Anthropic 最初将 Mythos Preview 定位于 Project Glasswing 中,这是其用于保护关键软件的倡议。此次密码学披露显示了为什么 Anthropic 强调对网络模型的受控访问:这种研究能力可以产生需要专家审查和受控发布流程的攻击方法。

Amodeis 的安全论点现在经受了一次算法层面的检验。其直接的运行影响有限,但创始人和安全负责人必须决定如何在类似方法影响承载生产流量的密码学之前验证、限制并负责任地披露模型生成的攻击。能够在标准化过程中识别出薄弱设计的模型,或能帮助厂商避免代价高昂的部署。是否构成可信攻击仍由专家审查来决定。

Reader comments

Conversation for this story loads after sign-in.