OpenAIは、顧客のプロンプトやモデルの応答を保持することなく、複数の関連するAPIインタラクション全体で安全性リスクを特定するために設計されたシステムである「Private Safety Processing」をプレビューしています。このアップデートは、OpenAIのスタッフが基盤となるコンテンツにアクセスすることを確実に防ぎながら、潜在的に有害な意図のパターンを検出できる自動化システムを可能にすることで、同社のゼロデータ保持(ZDR)の約束をサポートします。
- システムは各インタラクションを個別に評価するのではなく、関連するインタラクション全体でパターンを評価し、複雑なタスクや協調的なプロービングから生じるリスクに対処します。
- 顧客のコンテンツは顧客が制御するインフラストラクチャ上に留まるか、顧客が制御する鍵で暗号化されたOpenAIのインフラストラクチャに保存されます。
- リスクが検出されると、OpenAIはフラグ付けされたコンテンツへのアクセスなしで、アクティビティの種類を示す狭く定義されたシグナルのみを受信します。
- この機能は現在早期顧客とテスト中であり、技術的なホワイトペーパーとともに9月のロールアウトが計画されています。
このアプローチは、安全モニタリングの要件と企業のセキュリティ義務との間の競合を解決し、金融記録や健康データのような機密データが顧客の管理下にあることを確保しつつ、効果的な保護措置を維持することを目指しています。