Anthropic bekerja sama dengan bisnis AI khusus Accenture untuk melakukan evaluasi independen dan red-teaming pada model-model terdepannya. Inisiatif ini mendukung komitmen Anthropic untuk menempatkan evaluator di dalam perusahaan, memungkinkan mereka memantau pengembangan model dan memverifikasi komitmen keamanan.

  • Kemitraan ini melibatkan evaluasi model, penilaian keselarasan, dan pengujian langkah-langkah pengamanan.
  • Kedua perusahaan berharap menginvestasikan setidaknya $1 miliar di bidang ini selama lima tahun ke depan.
  • Evaluator yang tertanam akan memiliki akses yang setara dengan karyawan untuk mengamati proses pelatihan dan mengidentifikasi titik buta.
  • Anthropic akan mendanai langsung pekerjaan Accenture sambil mengeksplorasi pengaturan pendanaan lain untuk evaluator di masa depan.

Pendekatan ini bertujuan membuat akuntabilitas lebih dapat diverifikasi dengan memungkinkan pihak independen menilai bagaimana model dibangun dan diterapkan, meskipun standar untuk evaluasi tertanam semacam itu masih sedang dikembangkan.