الموضوع · Reasoning models
lab OpenAI News · منذ 24 يوم · 40 مشاهدة

تحذير من OpenAI بشأن مخاطر الذكاء الاصطناعي مع توسع نماذج الاستدلال

تناولت OpenAI في مقال بعنوان "عقل غريب" التقدم السريع لنماذج اللغة القائمة على الاستدلال وإمكانية التحسين الذاتي المتكرر. يعرب الكاتب عن قلقه من أن الذكاء الآلي يتجاوز القدرات البشرية بطرق تحويلية، مدفوعاً بشكل أساسي بتوسيع القوة الحاسوبية بدلاً من الخوارزميات المصممة.

lab NVIDIA Research · منذ 19 يوم · 13 مشاهدة

يستخدم ReasAlign الاستدلال للدفاع عن وكلاء نماذج اللغات الكبيرة ضد حقن الأوامر

قدم الباحثون ReasAlign، وهو حل على مستوى النموذج مصمم لتحسين محاذاة السلامة في نماذج اللغات الكبيرة (LLLMs) ضد هجمات حقن الأوامر غير المباشرة. يدمج النهج خطوات استدلال منظمة لتحليل استفسارات المستخدم واكتشاف التعليمات المتضاربة، مما يضمن استمرارية المهام المقصودة من قبل المستخدم.

media AI News (smol.ai) · منذ 18 يوم · 31 مشاهدة

OpenAI تدّعي تحقيق نتيجة حول تفرد معادلات نافير-ستوكس بمساعدة الذكاء الاصطناعي عبر تعاون 10,000 وكيل

أفادت حسابات تابعة لـ OpenAI بأن جهداً مدعوماً بالذكاء الاصطناعي أنتج نتيجة تتعلق بمشكلة وجود وانتظام حلول معادلات نافير-ستوكس، وهي واحدة من مسائل جائزة الألفية. يدور الادعاء حول نظام تعاوني يتضمن حوالي 10,000 وكيل تم تدريبها على مدار عام باستخدام التعلم التعزيزي متعدد الوكلاء.

media Ahead of AI · منذ 21 يوم · 31 مشاهدة

OpenAI تطلق GPT-6 Astra مع قدرات عرض ثلاثي الأبعاد قوية واستخدام الكمبيوتر

أطلقت OpenAI نموذج GPT-6 Astra الجديد، الذي يتفوق بشكل كبير على سلفه GPT-5.6 في معايير الكتابة والرياضيات والبرمجة. يسلط الإصدار الضوء على القدرات الاستثنائية للنموذج في العرض ثلاثي الأبعاد، والرسوم المتحركة، والتفاعل مع واجهة المستخدم الرسومية.

arxiv arXiv cs.CL · منذ 2 يوم · مشاهدة واحدة

TokenProbe يقلل استخدام رموز CoT بنسبة 76% مع الحفاظ على الدقة

يقدم الباحثون TokenProbe، وهو إطار عمل يعالج الاستهلاك العالي للرموز في استدلال Chain-of-Thought من خلال استغلال القيمة غير المتجانسة للرموز داخل مسارات الاستدلال. يميز الأسلوب بين الرموز الأساسية الحاملة للمحتوى الحاسم والحشو الزائد باستخدام إشارات الاحتمال اللوغاريتمي المعياري.

arxiv arXiv cs.CL · منذ 8 يوم · 19 مشاهدة

TelecomGPT-R1: تدريب موحد ما بعد التدريب للاستدلال عبر مهام اتصالات متنوعة

يقدم الباحثون TelecomGPT-R1، وهو عائلة من نماذج استدلال الاتصالات المفتوحة المصدر والموحدة، مصممة لأتمتة المهام الهندسية من خلال الاستدلال على المعايير والتكوينات والسجلات. يتناول النموذج قيود نماذج الذكاء الاصطناعي التوليدية العامة والمتخصصة الحالية من خلال نهج هيكلي يغطي محاور البروتوكول والمعرفة والنمذجة والأعطال.

media Hugging Face Forums · منذ 9 يوم · 14 مشاهدة

CosmicUndercurrent تطلق Principia-Structurae-Realitatis لاختبار تنسيق النظام الكامل لنماذج اللغات الكبيرة

أطلقت CosmicUndercurrent إطار عمل استدلالي غير محدد لنموذج معين، مصممًا لاختبار ما إذا كان التمهيض الهيكلي يمكن أن يقلل من عدم الاتساق العالمي في نماذج اللغات الكبيرة. يستضيف المشروع التحقيق فيما إذا كانت العملية ذات الخطوتين تحسّن تنسيق النظام الكامل مقارنةً بالصحة المحلية.

blog Simon Willison · منذ 29 يوم · 46 مشاهدة

أنثروبيك تطلق كلاود فابل 5.1 بمعايير محسّنة للبرمجة والعلوم

أطلقت أنثروبيك كلاود فابل 5.1، وهو تحديث للنموذج يحدد معياراً جديداً لمهام البرمجة، والعمل المعرفي، وحل المشكلات طويلة الأمد. وتبرز الإصدار مكاسب أداء كبيرة على معيار Terminal-Bench-Science 0.1 الجديد، حيث حقق Fable 5.1 نتيجة بنسبة 52.6%، مقارنة بـ 24.7% لـ Fable 5، و29.0% لـ Opus 5، و22.4% لـ GPT-5.6 Sol.