白宫正在结束对开放式 AI 模型的安全审查豁免

预期的修订将取消对开放模型的豁免,一旦它们达到最强封闭系统的能力水平。

By · Published

Primary source: Wired

Why it matters

Open-model developers may face the same federal release delays as closed labs, adding an uncertain security checkpoint before weights can be published.

Illustration of a White House policymaker's desk strewn with draft legislation and notes about open AI models and ending their security-review exemption.

白宫预计将把强大的开放 AI 模型纳入其预发布安全审查框架,撤销官员本月早些时候向 AI 开发者概述的豁免。

一名白宫官员告诉 Wired,开放模型一旦达到领先封闭系统的前沿能力,就将成为联邦测试的对象。报道称,这一变化预计将在未来几个月内发生。

该框架目前涵盖来自 Anthropic 和 OpenAI 等开发者的闭源模型。它要求联邦政府在更广泛发布之前评估先进系统的国家安全风险。参与仍是自愿的,政府已将完整框架置于不公开状态。

拟议的扩展将把开放模型开发者纳入一个最初围绕控制其系统访问的实验室设计的流程。当开放权重模型可以被下载、修改并独立运行时,一旦权重被公布,限制就更难执行。

带有截止日期的豁免

政府官员于 8 月 4 日向科技公司介绍了现行框架。Axios 报道称,在那些会议上讨论的版本排除了开放模型,并将受覆盖的系统定义为闭源、处于技术前沿且构成国家安全风险的模型。

该版本设想了最长 30 天的审查期,模型保存在安全环境中并通过详细日志记录访问情况。它将若干关键术语留作未定义,包括使模型成为审查对象的能力门槛。

据报道的修订将保留这种模糊性,同时延伸其后果。模型开发者可能直到官员评估其性能后才知道即将发布的版本是否跨过政府的前沿门槛。对于开放模型构建者来说,时机很重要,因为 30 天的延迟可能会扰乱权重、代码、评估和商业产品的协调发布。

这一扩展也解决了原始豁免造成的可信度问题。联邦审批过程如果仅适用于闭源系统,可能会给企业客户造成开放替代方案受到较少审查的印象。Wired 报道称,政府官员担心这种双层结构可能会阻碍美国开发者生产开放模型。

将同样的审查适用于开放发布会产生不同的问题。一旦可下载的模型通过能力门槛,政府可能会放慢其发布进程,尽管形式上参与是自愿的。该框架的实际效力将取决于联邦机构、承包商和受监管客户对那些拒绝参与的开发者要求提供何种访问。

华盛顿的开放模型冲突

预期的变化与政府公开支持开放 AI 的立场相悖。白宫的 July 2025 AI Action Plan 表示,开源和开放权重系统为创业公司提供了灵活性,使组织能够将敏感数据置于闭源模型供应商之外,并支持学术研究。该计划呼吁联邦政府为开放模型创造有利环境,并帮助小型企业采用它们。

白宫随后面临了一个更棘手的技术问题:接近前沿水平的开放模型可以被复制并由开发者控制范围之外的用户部署。Wired 报道称,官员们特别担心能够自主攻击军事或金融基础设施的系统。

政府已经为进一步行动留下了余地。7 月 15 日,Semafor 报道称,官员们正在考虑涉及开放模型和与中国相关的安全担忧的额外措施。National Cyber Director Sean Cairncross 表示,政府的工作包括对开源系统进行扫描和协调。

联邦审查也已开始影响闭源模型开发者发布产品的方式。Associated Press 报道 称,6 月份 OpenAI 和 Anthropic 在政府审查期间限制了对新系统的访问。OpenAI 当时表示,它不希望政府访问成为长期默认。

白宫 6 月 5 日的 national security AI directive 则另外指示国防和情报机构采用先进的商业与开源技术,同时确保部署的系统仍可控且可追责。

这些政策将开放模型开发者置于两项联邦目标之间:华盛顿希望美国的开放模型作为中国系统的替代方案得到推广,而安全官员则希望在任何人能下载之前有能力检查具备能力的模型。将开放发布纳入审查框架为安全机构提供了一个检查点。将该过程保持为自愿、保密并基于未定义的前沿门槛,会使开发者无法获得 何时适用该检查点的稳定规则。

Reader comments

Conversation for this story loads after sign-in.