एंथ्रोपिक ने अपने आगामी मॉडल, अस्ट्रा से जुड़ी आंतरिक गतिविधियों को रोक दिया है, क्योंकि हालिया मूल्यांकनों से पता चलता है कि कंपनी की तैयारी ढांचे के तहत यह क्रांतिकीय साइबर सुरक्षा क्षमताएं रख सकता है। फर्म यह नहीं कह सकती कि मॉडल मानवीय हस्तक्षेप के बिना कड़े वास्तविक दुनिया के सिस्टम में शून्य-दिन एक्सप्लॉइट्स की पहचान और विकास कर सकता है।

  • अस्ट्रा ने एक सीमा को छुआ है जहां आंतरिक मूल्यांकनों और विशेषज्ञ आकलनों के आधार पर क्रांतिकीय साइबर क्षमताओं को नकारा नहीं जा सकता।
  • अस्ट्रा से जुड़ी आंतरिक गतिविधियां सुरक्षा नियंत्रण की बढ़ी हुई आवश्यकताओं को पूरा करने तक रोक दी गई हैं।
  • अधिक कठोर नियंत्रण में अलग किए गए परीक्षण वातावरण, सीमित नेटवर्क पहुंच, बढ़ाई गई वजन सुरक्षाएं और जोखिम भरे कार्यों के लिए सार्वभौमिक निगरानी शामिल हैं।
  • कंपनी सुरक्षा उपायों की मजबूती परीक्षण को बढ़ा रही है और सरकारी एजेंसियों और AI सुरक्षा संगठनों के साथ सहयोग करेगी।

एंथ्रोपिक का कहना है कि उन्नत साइबर-सक्षम मॉडल्स को रक्षकों को हमलावरों से पहले कमजोरियों की पहचान करने में मदद करनी चाहिए, जिसका उद्देश्य अग्रणी क्षमताओं को जिम्मेदारी से तैनात करना सुनिश्चित करना है।