OpenAI опубликовала структуру, описывающую её подход к поддержке независимых第三方оценки моделей передового ИИ. Организация подчеркивает, что эти оценки имеют решающее значение для баланса между ответственностью и подотчетностью, требуя глубокого доступа к данным обучения, оценки и развертывания.

  • Независимая оценка случаев безопасности, охватывающих обучение, внутреннее развертывание и внешнее развертывание.
  • Оценка критических мер защиты от adversarial testing, jailbreaks и повышения возможностей в областях с высоким риском.
  • Оценка метрик возможностей, охватывающих категории рисков готовности, такие как кибербезопасность и биологические риски.
  • Исследование критических инцидентов misalignment для выявления способствующих факторов и эффективности мер защиты.

Структура направлена на установление общих международных стандартов для практик безопасности и защиты, позволяя оценщикам оспаривать предположения лабораторий и проверять заявления о безопасности через строгую, безопасную и независимую работу.