2026年8月18日、OpenAI は Frontier モデルの API 顧客向けに「Zero Data Retention(ZDR)」と連携する新たな安全機能「Private Safety Processing」のプレビューを発表しました。この仕組みにより、顧客データへの OpenAI 社員のアクセスを制限しつつ、複数回のやり取りに潜むリスクを検出できる体制を整えます。
OpenAI は Frontier モデルの API を利用する資格のある顧客に対し、「Zero Data Retention(ZDR)」を提供しています。これはプロンプトやモデルの応答を処理後に保持しないという約束です。顧客のコンテンツは OpenAI 社員によるレビューの対象にならず、エンタープライズ顧客が明示的にオプトインしない限り、モデル学習には利用されません。
しかし、より複雑なタスクほど、複数のやり取りにわたって初めて顕在化するリスクも存在します。従来の ZDR 対応の安全システムは各やり取りを個別に評価していました。今回プレビューされる「Private Safety Processing」は、関連する一連のやり取りにおけるパターンを特定する仕組みです。
ZDR のデプロイメントでは、顧客コンテンツは顧客が管理するインフラ上に残ります。OpenAI 側で保管する場合も、鍵を顧客が制御した状態で暗号化します。いずれの場合でも、自動化されたシステムが潜在的な悪用を検出し、OpenAI 社員にプロンプトや応答の中身を見せることなく限定的な安全信号だけを返却できます。
危険な意図は、アカウント間での連携やエージェントの動作延長など、文脈の中で初めて明確になることがあります。この仕組みは正当な活動と悪用の区別を支援し、エージェントが意図された権限内にとどまることを保証します。リスクが検出されると、OpenAI はアクティビティの種類を示す狭義の信号を受け取ります。顧客は自社のシステムでアラートを調査でき、必要に応じて OpenAI に情報を共有して是正措置を訴求できます。
現在、この機能は初期顧客向けにテストされています。来月より展開を開始し、技術的なホワイトペーパーも公開するとしています。
