Anthropic сотрудничает со специализированным подразделением Accenture в области ИИ для проведения независимой оценки и тестирования на проникновение (red-teaming) своих передовых моделей. Эта инициатива поддерживает приверженность Anthropic внедрению оценщиков внутри компании, что позволяет им отслеживать разработку моделей и подтверждать обязательства по безопасности.
- Партнерство включает оценку моделей, проведение проверок соответствия и тестирование средств защиты.
- Обе компании планируют инвестировать не менее 1 миллиарда долларов в эту область в течение следующих пяти лет.
- Встроенные оценщики получат доступ, сопоставимый с доступом сотрудников, для наблюдения за процессами обучения и выявления слепых зон.
- Anthropic будет напрямую финансировать работу Accenture, одновременно изучая другие варианты финансирования для будущих оценщиков.
Этот подход направлен на повышение подотчетности за счет возможности независимых сторон оценивать, как модели создаются и развертываются, хотя стандарты для такой встроенной оценки все еще разрабатываются.