OpenAIが、データ保持ゼロを維持するよう設計されたセッション間の安全性チェックをプレビュー

Private Safety Processingは、関連するAPIのやり取り全体にわたってリスクパターンを追跡しつつ、OpenAIには限定的な安全性シグナルのみを提供します。

By · Published

Primary source: Sam Altman on X

Why it matters

Enterprise AI vendors need context across long-running agent tasks to detect abuse, but retaining customer prompts can block adoption. OpenAI is making privacy-preserving monitoring a competitive feature.

OpenAI previews cross-session safety checks designed to preserve zero data retention — Private Safety Processing will trace risk patterns across related API interactions while giving OpenAI only limited safety signals.

Sam Altman (@sama), OpenAIの共同創設者でCEOは水曜日、OpenAIが複数の関連するやり取りにまたがる不正使用を検出できる安全対策を導入するにあたり、適格なAPI顧客に対してzero data retentionを維持すると述べた。

OpenAIはそのシステムをPrivate Safety Processingと呼んでいる。同社は初期顧客とともにテストを行っており、9月に展開を開始する予定で、その際に技術的なホワイトペーパーを公開する見込みだ。

AltmanはX上で販売文句を5語にまとめた:「我々はビジネスのプライバシーを支援します!」。この基礎にある発表は、AIベンダーとそのエンタープライズ顧客にとって高まる問題に対処するものだ。より長期的なエージェント的タスクは、多数のプロンプト、アカウント、セッションにわたってリスクのある振る舞いを広げ得る一方で、医療記録、財務情報、独自のコード、内部計画を扱う企業は、モデル提供者がその素材を後日レビューのために保持することを許容できないことが多い。

How Private Safety Processing works

OpenAIの既存のZero Data Retentionプログラムは、適格なAPI機能を使用する承認組織に対して、顧客コンテンツを不正使用監視ログから除外している。同社の現行のAPIデータ制御ドキュメントによれば、標準の不正使用監視ログはそれ以外の場合、プロンプトや応答を含むことがあり、一般的に最長30日間保持される。

既存のZDR互換の保護策は個々のやり取りを個別に評価する。Private Safety Processingは、保護策への繰り返しの試行、アカウント間で協調された活動、ユーザーが停止を指示した後も動作を続けるエージェントなど、関連するやり取り全体にわたるパターンを認識することを目的としている。

ZDR展開の場合、OpenAIは基になるプロンプトと応答は顧客が管理するインフラ上に留まると説明している。OpenAIはまた、コンテンツが自社インフラ上に存在しつつ顧客が保持する鍵で暗号化される構成も開発している。OpenAIの人員はそれらの鍵のコピーを保有しない。

自動化されたシステムが保護されたコンテンツを処理し、疑わしい活動のカテゴリを記述する狭義のシグナルを返す。OpenAIは、人員がプロンプトやモデル応答そのものにアクセスすることなく、執行判断を支える可能性のあるそのシグナルを受け取ると述べている。

顧客はアラートを調査するために必要な記録を保持する。顧客はその後、執行判断に異議を唱える際、正当な活動を説明する際、もしくは確認された不正使用の調査を支援する際に関連資料をOpenAIと共有することを選べる。

Privacy becomes part of the model competition

OpenAIは設計を、顧客に安全性監視のためのコンテンツ保持を許可させることを要するフロンティアモデルの導入形態に対して明確に位置付けている。魅力は技術的というより商業的だ:より強力なモデルも、採用に際してセキュリティチームが機密データの管理権を手放さざるを得ないならば、規制対象の企業内での価値は限定される。

OpenAIは既に、APIおよびエンタープライズ製品からのビジネスデータは顧客がオプトインしない限りデフォルトでモデル学習から除外されると述べている。ZDRはさらに進み、適格なサービス上での不正使用監視とアプリケーション状態の保持を制限する。Private Safety Processingは、モデルがより長い時間軸にわたる業務を担うにつれて、その約束を拡張しようとするOpenAIの試みだ。

発表ではGlean、Databricks、Abridge、Microsoftがアプローチの形作りに協力する顧客として挙げられている。Gleanのセキュリティ責任者Sunil Agrawalは、エンタープライズの採用は顧客が自らの情報の管理権を保持し、選択したサービス外での直接的または派生的な利用を防止することに依存すると述べた。

その顧客ラインアップはOpenAIが保護しようとしている市場を示している。検索、データインフラ、ヘルスケア、職場向けソフトウェアの企業は、一般用途のレビューキューに投入できない記録を日常的に処理している。ZDRを維持することで、これらの企業はモデル提供者のニーズに合わせてデータガバナンスの約束を書き換えることなく、フロンティアモデルを展開する道を得る。

Zero retention still has boundaries

ZDRはすべてのOpenAI製品や機能を網羅する包括的な約束ではなく、承認ベースのAPI制御だ。OpenAIのドキュメントは、アプリケーション状態を保存するいくつかの機能やZDRと互換性がない機能を列挙している。例えば、バックグラウンド処理やCode Interpreterは、現行のドキュメントで説明されている標準的なZDR構成の下では使用できない。

児童性的虐待素材の可能性があるとフラグ付けされた画像については、法的および安全上の例外もある。OpenAIは、これらの画像はZDR展開を含め人によるレビューおよび法的に必要な報告のために引き続き保持されると述べている。

9月のホワイトペーパーがこの発表の背後にある技術的負担を背負うことになる。その中では、処理がどのように分離されるか、顧客が管理する鍵が実際にどのように機能するか、限定された安全シグナルがどのような情報を含むか、基になるコンテンツを露呈することなく誤検出にどのように対処するかを説明する必要がある。OpenAIは製品アーキテクチャと執行フローを示している。エンタープライズ向けプライバシーの訴求力は今、機構がAltmanが打ち出した境界を保持することを実証するかどうかにかかっている。

Reader comments

Conversation for this story loads after sign-in.