OpenAI는 프론트이어 AI 모델에 대한 독립적인 제3자 평가를 지원하기 위한 접근 방식을 설명하는 프레임워크를 게시했습니다. 이 조직은 이러한 평가가 책임과 책무 사이의 균형을 맞추는 데 중요하며, 학습, 평가 및 배포 데이터에 대한 심층적인 접근이 필요하다고 강조합니다.

  • 학습, 내부 배포 및 외부 배포를 아우르는 안전 사례에 대한 독립적인 평가.
  • 적대적 테스트, jailbreaks 및 고위험 영역에서의 능력 향상에 대한 중요한 보호 조치 평가.
  • 사이버 보안 및 생물학적 위험과 같은 준비도 위험 범주를 포함하는 능력 지표 평가.
  • 기여 요인과 보호 조치의 효과를 식별하기 위한 중요한 정렬 불일치 사건 조사.

이 프레임워크는 안전 및 보안 관행에 대한 공유된 국제 기준을 확립하여 평가자가 엄격하고 안전하며 독립적인 작업을 통해 연구소의 가정을 도전하고 안전 주장을 검증할 수 있도록 하는 것을 목표로 합니다.