OpenAI는 고객 프롬프트나 모델 응답을 저장하지 않고도 여러 관련 API 상호작용 전반에 걸쳐 안전 위험을 식별하도록 설계된 시스템인 '프라이빗 안전 처리(Private Safety Processing)'를 사전 공개하고 있습니다. 이 업데이트는 OpenAI 직원이 근본적인 콘텐츠에 접근하는 것을 보장하면서 잠재적으로 유해한 의도의 패턴을 감지할 수 있는 자동화 시스템을 허용함으로써 회사의 제로 데이터 보존(ZDR) 약속을 지원합니다.
- 해당 시스템은 각 상호작용을 개별적으로 평가하는 대신 관련 상호작용 전반의 패턴을 평가하여 복잡한 작업이나 조정된 탐색(probing)에서 발생하는 위험에 대응합니다.
- 고객 콘텐츠는 고객이 제어하는 인프라에 남아 있거나, 고객이 제어하는 키로 암호화된 OpenAI 인프라에 저장됩니다.
- 위험이 감지되면 OpenAI는 플래그가 지정된 콘텐츠에 접근하지 않고 활동 유형을 나타내는 좁게 정의된 신호만 받습니다.
- 이 기능은 현재 초기 고객들과 함께 테스트 중이며, 9월 기술 백서와 함께 출시될 예정입니다.
이 접근 방식은 안전 모니터링 요구사항과 기업 보안 의무 간 갈등을 해소하여 금융 기록이나 건강 데이터와 같은 민감한 데이터가 고객의 통제 하에 유지되는 동시에 효과적인 보호 장치를 유지하는 것을 목표로 합니다.