OpenAI、非公開安全処理を予告
- •OpenAIは、Zero Data Retentionのフロンティアモデル展開向けにPrivate Safety Processingを予告した
- •自動システムは、プロンプトや応答をOpenAI担当者に見せず関連対話のリスクを検知できる
- •Private Safety Processingは初期顧客とテスト中で、9月に展開とホワイトペーパー公開を予定する
OpenAIは2026年8月19日、フロンティアモデルを使う対象API顧客向けに、Zero Data Retentionと連携する安全システムとしてPrivate Safety Processingを予告した。Zero Data Retentionとは、OpenAIがリクエスト処理後に顧客のプロンプトやモデル応答を保持せず、顧客コンテンツをOpenAI担当者のレビュー対象にせず、企業顧客データを顧客が明示的に同意しない限りモデル訓練に使わない仕組みを指す。
Private Safety Processingは、基礎となるプロンプトや応答をOpenAI担当者に見せないまま、関連する複数のやり取りにまたがるリスクパターンを検知する設計だ。OpenAIによると、既存のZDR対応安全システムは各やり取りを個別に評価するが、重大なリスクの一部は複数のやり取り、反復的な保護措置の探索、協調したアカウント活動、偽装された脅威、停止指示後も続くエージェンティック・タスク(AIが複数段階の目標を遂行する作業)で初めて表れる可能性がある。
ZDR展開では、顧客コンテンツは顧客が管理するインフラ上に残る。OpenAIは、コンテンツをOpenAIのインフラに保存し、顧客が管理する鍵で暗号化する選択肢も開発している。OpenAI担当者はその鍵のコピーを持たない。どちらの方式でも、自動システムは潜在的な不正利用を特定し、基礎となる顧客コンテンツを露出させずに限定的な安全シグナルを返せる。
自動システムがリスクを特定すると、OpenAIは現在の安全システムと同様に、関係する活動の種類について狭く定義されたシグナルを受け取る。OpenAIは、そのシグナルが執行判断を支援し得るとしたが、担当者はフラグ付けされた顧客コンテンツへ引き続きアクセスできない。顧客は自社システムでアラートを調査でき、異議申し立て、正当な活動の説明、確認済み悪用の調査のために、関連情報をOpenAIと共有することを選べる。
OpenAIによると、Private Safety Processingは初期顧客とテスト中であり、金融記録、健康データ、機密事業計画、専有研究を扱うさまざまな業界、地域、企業規模の組織からの意見で形作られている。Gleanの最高情報セキュリティ責任者であるスニル・アグラワル(Sunil Agrawal)は、企業のAI導入はデータに対する顧客の管理と、選択したサービスを超える直接的または派生的な利用がないことに依存すると述べた。
OpenAIは9月にPrivate Safety Processingの展開を開始し、技術ホワイトペーパーを公開する予定だ。法的注記では、児童性的虐待資料の可能性があるとしてフラグ付けされた画像は、Zero Data Retention展開でも、法律で求められる手動レビューと報告のため引き続き保持されるとされた。