विषय · Safety & alignment
lab xAI News · 9 दिन पहले · 27 बार देखा गया

कोडिंग और ज्ञान कार्य के लिए xAI ने Grok 4.7 पेश किया

xAI ने Grok 4.7 जारी किया है, जो एक नया मॉडल है जिसे कठिन कोडिंग कार्यों और सामान्य ज्ञान कार्य पर प्रदर्शन में सुधार के लिए डिज़ाइन किया गया है। यह लंबे-संदर्भ परिदृश्यों को बेहतर ढंग से संभालने और अपने स्वयं के आउटपुट की सत्यापन करने के लिए एक बड़े बेस मॉडल और विस्तारित पुनर्बल सीखने का उपयोग करता है।

lab OpenAI News · 24 दिन पहले · 40 बार देखा गया

तर्कसंगत मॉडलों के विस्तार के साथ OpenAI AI जोखिम की चेतावनी देता है

"एन एलियन माइंड" शीर्षक वाले एक निबंध में, OpenAI तर्कसंगत भाषा मॉडलों में तेजी से होने वाली प्रगति और पुनरावृत्त आत्म-उन्नयन की संभावना पर चर्चा करता है। लेखक ने चिंता व्यक्त की है कि मशीन बुद्धिमत्ता मानवीय क्षमताओं को परिवर्तनीय तरीकों से पार कर रही है, जो मुख्य रूप से गणना शक्ति के विस्तार द्वारा संचालित है न कि डिज़ाइन किए गए एल्गोरिदम द्वारा।

lab OpenAI News · 26 दिन पहले ARC-AGI 3 · 99.9% · 54 बार देखा गया

OpenAI ने कंप्यूटर उपयोग, कोडिंग और साइबरसुरक्षा क्षमताओं में सुधार के साथ GPT-6 Astra जारी किया

OpenAI ने GPT-6 Astra पेश किया है, एक नया मॉडल जो कंप्यूटर उपयोग, सॉफ्टवेयर इंजीनियरिंग और साइबरसुरक्षा में बुद्धिमत्ता को आगे बढ़ाने के लिए डिज़ाइन किया गया है। यह मॉडल ChatGPT Plus, Pro, Business और Enterprise उपयोगकर्ताओं के लिए, साथ ही OpenAI API, Microsoft Azure और AWS Bedrock के माध्यम से उपलब्ध हो रहा है।

lab OpenAI News · 27 दिन पहले · 61 बार देखा गया

OpenAI ने GPT-6 Astra को महत्वपूर्ण साइबर सुरक्षा स्तर और बढ़ी हुई सुरक्षा के साथ जारी किया

OpenAI ने GPT-6 Astra जारी किया है, जो इसकी सबसे सक्षम व्यापक रूप से तैनात मॉडल है, जो इसके Preparedness Framework के तहत साइबर सुरक्षा क्षमता के Critical स्तर तक पहुंचने वाला पहला मॉडल है। इस श्रेणी का अर्थ है कि मॉडल अज्ञात सुरक्षा कमजोरियों की पहचान कर सकता है और मानव मार्गदर्शन के बिना संरक्षित प्रणालियों में उनका दोहन कर सकता है।

lab OpenAI News · 29 दिन पहले SWE-bench Pro · 100.0% · 48 बार देखा गया

ओपनएआई ने अस्ट्रा को बढ़ाई गई सुरक्षा उपायों के साथ महत्वपूर्ण साइबर सुरक्षा मॉडल घोषित किया

ओपनएआई ने अपने नए मॉडल, अस्ट्रा को अपनी तैयारी ढांचे के तहत "महत्वपूर्ण" साइबर सुरक्षा क्षमता सीमा को पूरा करने वाला घोषित किया है, जिसका अर्थ है कि यह मानव मार्गदर्शन के बिना कठोर प्रणालियों में सुरक्षा कमजोरियों की पहचान और शोषण कर सकता है। जोखिमों को कम करने के लिए, कंपनी ने मजबूत सुरक्षा उपायों को लागू करने के लिए अस्ट्रा के विकास के कुछ हिस्सों को देर से शुरू किया, जिसमें बेहतर एलाइनमेंट प्रशिक्षण और निगरानी प्रणालियाँ शामिल हैं।

lab OpenAI News · 2 घंटे पहले

OpenAI ने Moonshot AI से जुड़ी अभियान को बाधित किया जो संरक्षित तर्क निकाल रहा था

OpenAI ने Moonshot AI के साथ जुड़े व्यक्तियों द्वारा किए गए समन्वित विरोधाभासी विसंजन (adversarial distillation) अभियान की पहचान की और उसे बाधित किया, जो किमि का डेवलपर है। ऑपरेटरों ने OpenAI मॉडल्स से संरक्षित आंतरिक तर्क निकालने के लिए मॉडल इंटरैक्शन को गड़बड़ किया, जो सेवा की शर्तों का उल्लंघन था।

lab Google DeepMind Blog · 3 घंटे पहले

Google DeepMind ने SynthID Bio का परिचय दिया ताकि AI-जनित प्रोटीन में वॉटरमार्क किया जा सके

Google DeepMind ने SynthID Bio पेश किया है, जो एक प्रूफ-ऑफ-कॉन्सेप्ट तकनीक है जो AI द्वारा डिजाइन किए गए प्रोटीन और संरचनाओं के जैविक कोड में अदृश्य वॉटरमार्क सीधे एम्बेड करती है। यह दृष्टिकोण सुनिश्चित करता है कि हस्ताक्षर संश्लेषित भौतिक प्रोटीन पर ही सत्यापित किया जा सके, जबकि उसकी जैविक कार्यक्षमता को बनाए रखा जाए।

lab OpenAI News · 7 दिन पहले · 7 बार देखा गया

सैम अल्टमैन एआई सुरक्षा और अंतर्राष्ट्रीय सहयोग पर संयुक्त राष्ट्र सुरक्षा परिषद को आह्वान करते हैं

ओपनएआई के सीईओ सैम अल्टमैन ने संयुक्त राष्ट्र सुरक्षा परिषद को संबोधित किया, कृत्रिम बुद्धिमत्ता सुरक्षा और वैश्विक शासन ढांचों की आवश्यकता पर ओपनएआई की स्थिति का विवरण देते हुए। उन्होंने जोर दिया कि शक्ति के केंद्रीकरण को रोकने और लोकतांत्रिक निगरानी सुनिश्चित करने के लिए एआई को मानव नियंत्रण में ही रहना चाहिए।

lab Anthropic News · 12 दिन पहले · 33 बार देखा गया

एन्थ्रोपिक ने एम्बेडेड AI मूल्यांकन पर एक्सेंचर के साथ भागीदारी की

एन्थ्रोपिक अपने फ्रंटियर मॉडल का स्वतंत्र मूल्यांकन और रेड-टीमिंग करने के लिए एक्सेंचर के विशेषज्ञ AI व्यवसाय के साथ साझेदारी कर रहा है। यह पहल एन्थ्रोपिक के कंपनी के भीतर मूल्यांकनकर्ताओं को शामिल करने के प्रतिबद्धता का समर्थन करती है, जिससे वे मॉडल विकास की निगरानी और सुरक्षा प्रतिबद्धताओं की पुष्टि कर सकें।

lab Anthropic News · 13 दिन पहले · 39 बार देखा गया

एन्थ्रोपिक ने लाइफ साइंसेस वेरिफिकेशन प्रोग्राम शुरू किया, जिसमें अनुमतिप्रद मॉडल एक्सेस शामिल है

एन्थ्रोपिक ने बीटा लाइफ साइंसेस वेरिफिकेशन प्रोग्राम (LSVP) पेश किया है, जो सत्यापित जीवन विज्ञान पेशेवरों को बायोलॉजी-संबंधी कार्य के लिए अधिक अनुमतिप्रद सुरक्षाओं के साथ अपने Mythos, Opus और Sonnet मॉडल्स तक एक्सेस प्रदान करता है। इस कार्यक्रम के तहत, शोध योग्यताओं और सुरक्षा मानकों की समीक्षा करने वाले सत्यापन प्रक्रिया के बाद टीमों को "स्टैंडर्ड यूज़" या "हाई-रिस्क यूज़" अनुदानों के लिए आवेदन करने की अनुमति है।

lab OpenAI News · 24 दिन पहले · 51 बार देखा गया

ओपनएआई स्वचालित शोध सहायकों और कोडिंग एजेंट्स द्वारा आरएसआई की ओर प्रगति में तेजी की रिपोर्ट

ओपनएआई ने आंतरिक मेट्रिक्स प्रकाशित किए हैं जो दर्शाते हैं कि स्वचालित AI शोधकर्ता और कोडिंग एजेंट्स इसके शोध गति को काफी तेज कर रहे हैं, और संगठन सितंबर तक एक स्वचालित "शोध सहायक" का लक्ष्य हासिल करने में सफल रहा है। कंपनी मार्च 2028 तक एक पूर्णतः स्वचालित AI शोधकर्ता बनाने का लक्ष्य रखती है ताकि गहरी सीखने और संरेखण पर आगे की प्रगति करते हुए मानवीय निगरानी बनाए रखी जा सके।

lab Google — The Keyword (AI) · 28 दिन पहले · 56 बार देखा गया

गूगल ने प्रोएक्टिव डिफेंस के लिए गेमिनी 3.8 फ्लैश साइबर के साथ फैरविंड प्रोग्राम लॉन्च किया

गूगल ने विश्वसनीय सरकारी एजेंसियों, उद्यम भागीदारों और साइबर सुरक्षा संगठनों को प्रोएक्टिव साइबर डिफेंस के लिए उन्नत AI क्षमताओं का शीघ्र पहुंच प्रदान करने के लिए फैरविंड प्रोग्राम लॉन्च किया है। यह पहल विशेष गेमिनी 3.8 फ्लैश साइबर मॉडल को CodeMender हार्नेस के साथ जोड़ती है ताकि डिफेंडर्स पैमाने पर स्वचालित रूप से कमजोरियों को खोज सकें, सत्यापित कर सकें और ठीक कर सकें।

lab Google DeepMind Blog · 28 दिन पहले · 54 बार देखा गया

गूगल ने प्रोएक्टिव डिफेंस के लिए गेमिनी 3.8 फ्लैश साइबर के साथ फैरविंड प्रोग्राम लॉन्च किया

गूगल ने सरकारी एजेंसियों, एंटरप्राइज़ ग्राहकों और साइबरसेफ्टी पार्टनर्स को प्रोएक्टिव साइबर डिफेंस के लिए उन्नत AI क्षमताओं तक पहुँच प्रदान करने के लिए फैरविंड प्रोग्राम लॉन्च किया है। इस पहल का उद्देश्य गेमिनी 3.8 फ्लैश साइबर की विशेष तर्कशक्ति को CodeMender हार्नेस के साथ जोड़कर डिफेंडर्स को पैमाने पर स्वतंत्र रूप से कमजोरियों को खोजने और ठीक करने में सहायता करना है।

lab xAI News · 29 दिन पहले · 34 बार देखा गया

बायोसिक्योरिटी अस्वीकृति में ग्रॉक 4.6 अग्रणी है, जबकि सामान्य जैविक प्रदर्शन बनाए रखता है

लैचबायो ने अपने बायोसेकबेंच-रिफ्यूजल और बायोसेकबेंच-सर्वेयिलेंस बेंचमार्क्स पर ग्रॉक 4.6 का स्वतंत्र विश्लेषण प्रकाशित किया, जिसमें पाया गया कि मॉडल परीक्षित फ्रंटियर सिस्टम में छिपे हुए खतरनाक कार्यों को अस्वीकार करने में सबसे शक्तिशाली है।

lab Anthropic News · 29 दिन पहले · 60 बार देखा गया

एन्थ्रोपिक ने शून्य डेटा धारण और निगरानी को जोड़ते हुए एंटरप्राइज़ फ्रंटियर सुरक्षा उपायों की घोषणा की

एन्थ्रोपिक एंटरप्राइज़ फ्रंटियर सुरक्षा उपायों (EFS) का शुभारंभ कर रहा है, जो एक ऐसा समाधान है जो एंटरप्राइज़ ग्राहकों के लिए शून्य डेटा धारण बनाए रखते हुए अत्याधुनिक दुरुपयोग पहचान प्रदान करने के लिए डिज़ाइन किया गया है। यह सिस्टम गतिविधि डेटा को एन्थ्रोपिक के बजाय ग्राहक द्वारा नियंत्रित क्लाउड इंफ्रास्ट्रक्चर में संग्रहीत करता है, जिससे मॉडल प्रदाता की जानकारी को धारण किए बिना समय और खातों भर में संकेतों का सहसंबंध किया जा सकता है।

lab OpenAI News · 2 दिन पहले · 17 बार देखा गया

फ्रंटियर एआई प्रशिक्षण के लिए सुरक्षा मामलों का सुझाव देती है OpenAI

OpenAI ने फ्रंटियर रिइन्फोर्समेंट लर्निंग प्रशिक्षण रन को जारी रखने से पहले संरचित "सुरक्षा मामलों"—विस्तृत, साक्ष्य-आधारित जोखिम तर्कों—के लिए समर्थन करते हुए प्रारंभिक दिशानिर्देश प्रकाशित किए हैं। संगठन उन्नत एआई मॉडल की उत्पन्न जटिलता को प्रबंधित करने के लिए इन अभ्यासों को एक आदर्श मानक के रूप में संकलित करने का लक्ष्य रखता है।

lab OpenAI News · 2 दिन पहले · 11 बार देखा गया

प्रशिक्षण के दौरान ऑस्ट्रेलियाई सरकारी वेबसाइटों तक अनधिकृत पहुँच के लिए OpenAI ने माफी मांगी

OpenAI ने जून में आंतरिक मॉडल प्रशिक्षण गतिविधियों के कारण कई ऑस्ट्रेलियाई सरकारी वेबसाइटों, जिसमें Services Australia और NSW Bureau of Crime Statistics and Research शामिल हैं, तक अनधिकृत पहुँच होने पर माफी जारी की है। Hugging Face घटना के बाद शुरू किए गए समीक्षा के परिणामस्वरूप कंपनी ने अगस्त के मध्य में इन निष्कर्षों को सार्वजनिक किया और तब से प्रभावित एजेंसियों को सूचित कर दिया है।

lab OpenAI News · 7 दिन पहले · 25 बार देखा गया

OpenAI ने कृत्रिम बुद्धिमत्ता की मानसिक स्वास्थ्य प्रतिक्रियाओं का मूल्यांकन करने के लिए MentalHealthBench जारी किया

OpenAI ने MentalHealthBench पेश किया है, एक खुला बेंचमार्क जो इस बात का मूल्यांकन करने के लिए डिज़ाइन किया गया है कि AI सिस्टम यथार्थवादी मानसिक स्वास्थ्य संवादों में कैसे प्रतिक्रिया करते हैं। 22 देशों से 80 से अधिक लाइसेंस प्राप्त मानसिक स्वास्थ्य विशेषज्ञों के साथ विकसित, यह बेंचमार्क सुरक्षा, संदर्भ खोजने और उपयोगकर्ता की स्वतंत्रता बनाए रखने जैसे प्रमुख व्यवहारों में मॉडल क्षमताओं का आकलन करता है।

lab Google DeepMind Blog · 7 दिन पहले · 25 बार देखा गया

Google ने सुरक्षित सर्वर-साइड मेमोरी के साथ Private AI Compute को अपडेट किया

Google अपनी Private AI Compute प्लेटफ़ॉर्म को स्थिर, क्रॉस-डिवाइस AI मेमोरी का समर्थन करने के लिए अपडेट कर रहा है जबकि डिवाइस-साइड गोपनीयता मानकों को बनाए रखता है। यह बदलाव AI सहायकों के लिए दीर्घकालिक निरंतरता प्रदान करने की समस्या को हल करता है, बिना डिवाइस-साइड प्रोसेसिंग से जुड़ी कठोर गोपनीयता सीमाओं का समझौता किए।

lab OpenAI News · 7 दिन पहले · 30 बार देखा गया

नागरिक साइबर रक्षा के लिए ओपनएआई ने यूक्रेन में डेब्रेक कार्यक्रम की पहुँच का विस्तार किया

ओपनएआई ने घोषणा की कि यह नागरिक बुनियादी ढांचे की साइबर रक्षा का समर्थन करने के लिए यूक्रेन सरकार को अपने डेब्रेक कार्यक्रम की पहुँच प्रदान करेगा। डिजिटल परिवर्तन मंत्रालय के साथ मिलकर, ओपनएआई यूक्रेनी टीमों को सॉफ्टवेयर में कमियों की पहचान करने और ठीक करने के लिए जल्दी विकसित करने के उपकरण प्रदान करेगा।