OpenAI 预览旨在实现零数据保留的跨会话安全检查

Private Safety Processing 将在相关 API 交互中追踪风险模式,同时仅向 OpenAI 提供有限的安全信号。

By · Published

Primary source: Sam Altman on X

Why it matters

Enterprise AI vendors need context across long-running agent tasks to detect abuse, but retaining customer prompts can block adoption. OpenAI is making privacy-preserving monitoring a competitive feature.

OpenAI previews cross-session safety checks designed to preserve zero data retention — Private Safety Processing will trace risk patterns across related API interactions while giving OpenAI only limited safety signals.

Sam Altman (@sama), OpenAI 的联合创始人兼首席执行官,周三表示,在推出能够跨多次相关交互检测滥用的安全系统时,OpenAI 将为符合条件的 API 客户保留 Zero Data Retention(零数据保留)政策。

OpenAI 将该系统称为 Private Safety Processing。公司正在与早期客户进行测试,并计划于九月开始逐步推出,同时预计会发布一篇技术白皮书。

Altman 在 X 上用五个词概括了推销词:“we support business privacy!” 这一底层公告针对的是 AI 厂商及其企业客户面临的一个日益突出的难题。较长的具代理性质的任务可能会将风险行为扩散到许多提示、账户或会话中,而处理病历、财务信息、专有代码和内部计划的企业通常不能允许模型提供方为事后审查而保留这些材料。

How Private Safety Processing works

OpenAI 现有的 Zero Data Retention 计划在获批的组织使用符合条件的 API 功能时,将客户内容从滥用监控日志中排除。公司的当前 API 数据控制文档 表示,标准的滥用监控日志否则可能包含提示和响应,且通常会保留最长约 30 天。

现有与 ZDR 兼容的保障措施对交互逐一进行评估。Private Safety Processing 旨在识别跨相关交互的模式,包括反复尝试探测防护措施、跨账户协调的活动以及在用户要求停止后仍继续行动的代理。

对于 ZDR 部署,OpenAI 表示底层的提示和响应将保留在客户控制的基础设施上。OpenAI 还在开发一种配置,使得内容可以放在其基础设施上,同时由客户持有密钥进行加密。OpenAI 人员将不会持有这些密钥的副本。

自动化系统将处理被保护的内容并返回一个定义狭窄的信号,描述被怀疑活动的类别。OpenAI 表示,其人员将收到该信号(可用于支持执法或合规决策),但不会获得产生该信号的提示或模型响应的访问权限。

客户将保留调查警报所需的记录。随后他们可以选择在对执法决定提出异议、解释合法活动或协助对已核实滥用的调查时,将相关材料共享给 OpenAI。

Privacy becomes part of the model competition

OpenAI 明确将该设计定位为对那些要求客户允许为安全监控而保留内容的前沿模型部署的对策。这一吸引力既是商业性的,也是技术性的:如果采用更强大的模型会迫使安全团队放弃对敏感数据的控制,那么在受监管公司内部,这种更强模型的价值就会大打折扣。

OpenAI 已经表示,其 API 和企业产品中的业务数据默认不用于模型训练,除非客户选择加入。ZDR 更进一步,限制了符合条件服务上用于滥用监控和应用状态的保留。Private Safety Processing 是 OpenAI 试图在其模型承担更长时间跨度工作的过程中扩展这一承诺的做法。

该公告提到 Glean、Databricks、Abridge 和 Microsoft 作为参与塑造该方法的客户。Glean 安全负责人 Sunil Agrawal 表示,企业采纳取决于客户能否保留对其信息的控制,并防止在所选服务之外的直接或衍生使用。

这一客户阵容指向了 OpenAI 正在保护的市场。搜索、数据基础设施、医疗保健和办公软件公司经常处理不能放入通用审查队列的记录。保留 ZDR 为这些企业提供了一条路径,使其能够部署前沿模型,而无需围绕模型提供方的需求重写其数据治理承诺。

Zero retention still has boundaries

ZDR 是一种基于审批的 API 控制,而不是覆盖每一款 OpenAI 产品和功能的全面承诺。OpenAI 的文档列出了一些会存储应用状态或仍与 ZDR 不兼容的功能。例如,后台处理和 Code Interpreter 在当前文档所描述的标准 ZDR 配置下无法使用。

对于被标记为潜在儿童性虐待材料的图像,也存在法律和安全方面的例外。OpenAI 表示,这些图像将继续被保留以供人工审核和依法报告,包括在 ZDR 部署中也是如此。

九月的白皮书将承担公告背后的技术说明。它需要解释处理如何被隔离、客户控制密钥在实践中如何运作、有限的安全信号包含哪些信息以及系统如何在不暴露底层内容的情况下处理误报。OpenAI 已经阐明了产品架构和执法流程。其企业隐私主张现在取决于证明这些机制能够维持 Altman 所宣称的边界。

Reader comments

Conversation for this story loads after sign-in.