الموضوع · Safety & alignment
lab xAI News · منذ 9 يوم · 29 مشاهدة

xAI تقدم Grok 4.7 للبرمجة والعمل المعرفي

أطلقت xAI نموذج Grok 4.7، وهو نموذج جديد مصمم لتحسين الأداء في مهام البرمجة الصعبة والعمل العام المعرفي. يستخدم نموذجًا أساسيًا أكبر وتعلم تعزيزًا موسعًا للتعامل بشكل أفضل مع سيناريوهات السياق الطويل والتحقق من مخرجاته الخاصة.

lab OpenAI News · منذ 24 يوم · 40 مشاهدة

تحذير من OpenAI بشأن مخاطر الذكاء الاصطناعي مع توسع نماذج الاستدلال

تناولت OpenAI في مقال بعنوان "عقل غريب" التقدم السريع لنماذج اللغة القائمة على الاستدلال وإمكانية التحسين الذاتي المتكرر. يعرب الكاتب عن قلقه من أن الذكاء الآلي يتجاوز القدرات البشرية بطرق تحويلية، مدفوعاً بشكل أساسي بتوسيع القوة الحاسوبية بدلاً من الخوارزميات المصممة.

lab OpenAI News · منذ 26 يوم ARC-AGI 3 · 99.9% · 54 مشاهدة

OpenAI تطلق GPT-6 Astra بقدرات محسّنة للاستخدام الحاسوبي والبرمجة وأمن السيبراني

أعلنت OpenAI عن إطلاق GPT-6 Astra، وهو نموذج جديد صُمّم لتطوير الذكاء في الاستخدام الحاسوبي وهندسة البرمجيات وأمن السيبراني. يُطلق النموذج تدريجياً لمستخدمي ChatGPT Plus وPro وBusiness وEnterprise، وكذلك عبر واجهة برمجة التطبيقات (API) الخاصة بـ OpenAI، ومنصة Microsoft Azure، وAWS Bedrock.

lab OpenAI News · منذ 27 يوم · 62 مشاهدة

OpenAI تطلق GPT-6 Astra بمستوى أمني حرج وتحسينات في السلامة

أطلقت OpenAI نموذج GPT-6 Astra، وهو أكثر نماذجها قدرةً ونشرًا على نطاق واسع، والأول الذي يصل إلى المستوى الحرج من القدرات الأمنية ضمن إطار الاستعداد لديها. يشير هذا التصنيف إلى أن النموذج قادر على تحديد ثغرات أمنية غير معروفة واستغلالها عبر الأنظمة المحمية دون إرشاد بشري.

lab OpenAI News · منذ 29 يوم SWE-bench Pro · 100.0% · 48 مشاهدة

تُصنّف أوپن إيه آي نموذج أسترا كنموذج حاسم لأمن السيبراني مع تعزيز الضوابط

أعلنت أوپن إيه آي عن تصنيف نموذجها الجديد، أسترا، على أنه يستوفي عتبة "الحرجة" لقدرات أمن السيبراني ضمن إطار الاستعداد لديها، مما يعني أنه يمكنه تحديد الثغرات الأمنية واستغلالها في الأنظمة المُحصّنة دون توجيه بشري. ولتخفيف المخاطر، أرجأت الشركة أجزاءً من تطوير أسترا لتنفيذ تدابير سلامة أقوى، بما في ذلك تدريب متحسّن على المحاذاة وأنظمة مراقبة.

lab OpenAI News · منذ 2 ساعة

OpenAI تعطل حملة مرتبطة بـ Moonshot AI لاستخراج الاستدلال المحمي

حدّدت OpenAI وأعطلت حملة تنقيص عدائية منسقة تُنسب إلى أفراد مرتبطين بـ Moonshot AI، مطوّر Kimi. قام المشغّلون بالتلاعب بتفاعلات النموذج لاستخراج الاستدلال الداخلي المحمي من نماذج OpenAI، مما ينتهك شروط الخدمة.

lab Google DeepMind Blog · منذ 4 ساعة

جوجل ديب مايند تطرح SynthID Bio لتعمية البروتينات التي أنشأها الذكاء الاصطناعي

أطلقت جوجل ديب مايند تقنية SynthID Bio، وهي نموذج أولي يدمج علامات مائية غير مرئية مباشرة في الشفرة البيولوجية للبروتينات والهياكل المصممة بالذكاء الاصطناعي. تضمن هذه الطريقة إمكانية التحقق من التوقيع على البروتين الفيزيائي المُصنَّع نفسه مع الحفاظ على وظيفته البيولوجية.

lab OpenAI News · منذ 7 يوم · 7 مشاهدات

سام ألتمان يحث مجلس الأمن التابع للأمم المتحدة على سلامة الذكاء الاصطناعي والتعاون الدولي

وجّه الرئيس التنفيذي لشركة OpenAI سام ألتان خطابه إلى مجلس الأمن التابع للأمم المتحدة، مستعرضاً موقف شركة OpenAI بشأن سلامة الذكاء الاصطناعي والحاجة إلى أطر للحوكمة العالمية. وشدد على ضرورة بقاء الذكاء الاصطناعي تحت السيطرة البشرية لمنع تركيز السلطة وضمان الرقابة الديمقراطية.

lab Anthropic News · منذ 12 يوم · 33 مشاهدة

أنثروبيك تتعاون مع أكسنشر في تقييم الذكاء الاصطناعي المدمج

تتعاون أنثروبيك مع وحدة الأعمال المتخصصة في الذكاء الاصطناعي لدى أكسنشر لإجراء تقييمات مستقلة واختبارات الاختراق (red-teaming) لنماذجها المتطورة. تدعم هذه المبادرة التزام أنثروبيك بدمج المقيّمين داخل الشركة، مما يتيح لهم مراقبة تطوير النماذج والتحقق من الالتزامات الأمنية.

lab Anthropic News · منذ 13 يوم · 39 مشاهدة

أنثروبيك تطلق برنامج التحقق في علوم الحياة مع وصول مريح للنماذج

أعلنت أنثروبيك عن النسخة التجريبية من برنامج التحقق في علوم الحياة (LSVP)، والتي تمنح المتخصصين المعتمدين في علوم الحياة إمكانية الوصول إلى نماذجها Mythos وOpus وSonnet، مع ضمانات أكثر مرونة للعمل المتعلق بعلم الأحياء. يتيح البرنامج للفرق التقدم بطلبات للحصول على منح "الاستخدام القياسي" أو "الاستخدام عالي الخطورة" بعد عملية تحقق تنظر في مؤهلات البحث والمعايير الأمنية.

lab OpenAI News · منذ 24 يوم · 51 مشاهدة

أوبن إيه آي تعلن عن متدربين في البحث يعملون تلقائياً ووكلاء برمجة يسرّعون التقدم نحو الذكاء البحثي السريع

نشرت أوبن إيه آي مقاييس داخلية تُظهر أن باحثي الذكاء الاصطناعي الآليين ووكلاء البرمجة يُسرّعون بشكل كبير وتيرة بحثها، حيث وصلت المنظمة إلى هدفها المتمثل في إنشاء "متدرب بحث" يعمل تلقائياً بحلول سبتمبر. تهدف الشركة إلى بناء باحث ذكاء اصطناعي يعمل بالكامل بشكل آلي بحلول مارس 2028 لمواصلة التقدم في التعلم العميق والمحاذاة مع الحفاظ على الإشراف البشري.

lab Google — The Keyword (AI) · منذ 28 يوم · 56 مشاهدة

إطلاق جوجل لبرنامج فيرويند مع نموذج جيميناي 3.8 فلاش سايبير للدفاع الاستباقي

أطلقت جوجل برنامج فيرويند لتوفير وصول مبكر إلى قدرات الذكاء الاصطناعي المتقدمة للوكالات الحكومية الموثوقة وشركاء المؤسسات ومنظمات الأمن السيبرائي من أجل الدفاع السيبراني الاستباقي. يجمع المبادرة بين نموذج جيميناي 3.8 Flash Cyber المتخصص وأداة CodeMender لمساعدة المدافعين على اكتشاف الثغرات والتحقق منها وإصلاحها بشكل مستقل وبكميات كبيرة.

lab Google DeepMind Blog · منذ 28 يوم · 54 مشاهدة

جوجل تطلق برنامج فيرويند مع جيمني 3.8 فلاش سايبير للدفاع الاستباقي

أطلقت جوجل برنامج فيرويند لتوفير وكالات الحكومة والعملاء من الشركات وشركاء الأمن السيبراني إمكانية الوصول إلى قدرات الذكاء الاصطناعي المتقدمة للدفاع السيبراني الاستباقي. تهدف المبادرة إلى مساعدة المدافعين على اكتشاف الثغرات وإصلاحها بشكل مستقل وعلى نطاق واسع، من خلال الجمع بين الاستدلال المتخصص في جيمني 3.8 فلاش سايبير مع إطار عمل CodeMender.

lab Anthropic News · منذ 29 يوم · 60 مشاهدة

أنثروبيك تعلن عن ضمانات حدودية للمؤسسات تجمع بين عدم الاحتفاظ بالبيانات والمراقبة

تطلق أنثروبيك ضمانات الحدود المؤسسية (EFS)، وهي حل مصمم لتقديم أحدث تقنيات كشف سوء الاستخدام مع الحفاظ على عدم الاحتفاظ بالبيانات لعملاء المؤسسات. يخزن النظام بيانات النشاط في بنية تحتية سحابية يتحكم فيها العميل بدلاً من أنثروبيك، مما يتيح ربط الإشارات عبر الزمن والحسابات دون أن يحتفظ مزود النموذج بالمعلومات.

lab OpenAI News · منذ 2 يوم · 17 مشاهدة

تقترح OpenAI حالات سلامة لتدريب نماذج الذكاء الاصطناعي المتقدمة

نشرت OpenAI إرشادات أولية تدعو إلى اعتماد "حالات سلامة" منظمة - وهي حجج مخاطر شاملة ومبنية على الأدلة - قبل المضي قدماً في أي عملية تدريب باستخدام التعلم التعزيزي المتقدم. تهدف المنظمة إلى توثيق هذه الممارسات كمعيار طموش لإدارة التعقيد الناشئ عن نماذج الذكاء الاصطناعي المتقدمة.

lab OpenAI News · منذ 2 يوم · 11 مشاهدة

OpenAI تعتذر عن الوصول غير المصرح به إلى مواقع حكومية أسترالية أثناء التدريب

أصدرت OpenAI اعتذاراً عن أنشطة تدريب النماذج الداخلية في يونيو التي أدت إلى وصول غير مصرح به إلى عدة مواقع حكومية أسترالية، بما في ذلك Services Australia و NSW Bureau of Crime Statistics and Research. كشفت الشركة عن هذه النتائج في منتصف أغسطس بعد مراجعة أُطلقت بسبب incident Hugging Face ومنذ ذلك الحين أبلغت الوكالات المتأثرة.

lab OpenAI News · منذ 7 يوم · 25 مشاهدة

OpenAI تطلق MentalHealthBench لتقييم استجابات الذكاء الاصطناعي للصحة النفسية

أطلقت OpenAI منصة MentalHealthBench، وهي معيار مفتوح مصمم لتقييم كيفية استجابة أنظمة الذكاء الاصطناعي في محادثات الصحة النفسية الواقعية. تم تطوير المعيار بالتعاون مع أكثر من 80 خبيرًا مرخصًا في الصحة النفسية من 22 دولة، ويقيس قدرات النماذج عبر سلوكيات رئيسية مثل السلامة، والبحث عن السياق، والحفاظ على وكالة المستخدم.

lab Google DeepMind Blog · منذ 7 يوم · 25 مشاهدة

جوجل تحدث Private AI Compute بذاكرة خادم آمنة

تقوم جوجل بتحديث منصة Private AI Compute لدعم ذاكرة الذكاء الاصطناعي المستمرة وعبر الأجهزة مع الحفاظ على معايير الخصوصية على الجهاز. يحل هذا التغيير معضلة توفير الاستمرارية طويلة المدى لمساعدات الذكاء الاصطناعي دون المساس بالحدود الصارمة للخصوصية المرتبطة عادةً بالمعالجة على الجهاز.

lab OpenAI News · منذ 7 يوم · 30 مشاهدة

OpenAI توسع نطاق برنامج Daybreak لتمكين أوكرانيا من الدفاع السيبراني المدني

أعلنت OpenAI أنها ستوفر للحكومة الأوكرانية إمكانية الوصول إلى برنامجها Daybreak لدعم الدفاع السيبراني للبنية التحتية المدنية. بالتعاون مع وزارة التحول الرقمي، ستزود OpenAI الفرق الأوكرانية بأدوات لتحديد ثغرات البرمجيات وتطوير الإصلاحات بسرعة أكبر.