OpenAI ने एक ढांचा प्रकाशित किया है जो अग्रणी AI मॉडलों पर स्वतंत्र तीसरे पक्ष के आकलन को समर्थन देने के अपने दृष्टिकोण को रेखांकित करता है। संगठन पर जोर देता है कि ये आकलन जिम्मेदारी और जवाबदेही के बीच संतुलन बनाने के लिए महत्वपूर्ण हैं, जिसके लिए प्रशिक्षण, आकलन और तैनाती डेटा तक गहन पहुंच की आवश्यकता होती है।
- प्रशिक्षण, आंतरिक तैनाती और बाहरी तैनाती को कवर करने वाले सुरक्षा मामलों का स्वतंत्र आकलन।
- उच्च-जोखिम वाले क्षेत्रों में adversarial testing, jailbreaks और क्षमता वृद्धि के खिलाफ महत्वपूर्ण सुरक्षा उपायों का आकलन।
- तैयारी जोखिम श्रेणियों जैसे साइबर सुरक्षा और जैविक जोखिम को कवर करने वाली क्षमता मेट्रिक्स का आकलन।
- योगदान कारकों और सुरक्षा उपायों की प्रभावशीलता की पहचान करने के लिए महत्वपूर्ण misalignment घटनाओं की जांच।
इस ढांचे का उद्देश्य सुरक्षा और सुरक्षा अभ्यासों के लिए साझा अंतर्राष्ट्रीय मानक स्थापित करना है, जिससे आकलनकर्ता कठोर, सुरक्षित और स्वतंत्र कार्य के माध्यम से प्रयोगशालाओं की धारणाओं को चुनौती दे सकें और सुरक्षा दावों की पुष्टि कर सकें।