OpenAIは、ゼロデータ保持(ZDR)の約束を保ちながら複数の関連するAPIインタラクション全体で安全性リスクを特定するように設計されたシステムである「Private Safety Processing」をプレビューしています。このアップデートは、各インタラクションを個別に評価する既存のZDR互換システムの限界に対処するものであり、より長いコンテキストにおいてのみ見えるパターンを見逃す可能性があるという課題を解決します。
- このシステムは、OpenAIの担当者が基盤となるプロンプトやレスポンスにアクセスすることを許可することなく、関連するインタラクション全体でパターンを特定します。
- 顧客のコンテンツは顧客が制御するインフラストラクチャ上に留まるか、OpenAIのインフラストラクチャに保存される場合は顧客が制御する鍵で暗号化されます。
- リスクが検出されると、自動化されたシステムは限定的な安全シグナルを返すため、コンテンツをOpenAIスタッフに公開せずに執行判断を行うことができます。
- この機能は現在、早期顧客とテスト中であり、技術的なホワイトペーパーとともに9月の展開が計画されています。
このアプローチにより、OpenAIは複雑なタスク中にAIエージェントが意図された権限内に留まることを確保しつつ、ZDRデプロイメントを引き続き提供することが可能になります。これは、安全モニタリングの要件と機密データに関するエンタープライズセキュリティの義務との間の競合を解決することを目指しています。