الموضوع · Research paper
lab Google DeepMind Blog · منذ 8 يوم · 27 مشاهدة

Google DeepMind يُصدر نموذج WeatherNext الذكي للتنبؤ بالأعاصير كمصدر مفتوح

أطلقت Google DeepMind وGoogle Research نموذجي WeatherNext 2 وWeatherNext Cyclones كنماذج ذكية مفتوحة المصدر، والتي حققت دقةً متقدمة في التنبؤ بمسارات الأعاصير المدارية، وشدة العواصف، وهيكل الرياح. ونُشر العمل في مجلة Nature، ويُظهر أن هذه النماذج تمنح المتنبئين يوماً إضافياً من الدقة التنبؤية مقارنةً بالأنظمة السابقة.

lab OpenAI News · منذ 14 يوم · 23 مشاهدة

نموذج أسترا يحل عشر مسائل مفتوحة في الرياضيات وعلوم الحاسوب النظرية

أنتج النموذج الداخلي أسترا التابع لشركة OpenAI حلولاً لعشر مسائل مفتوحة طويلة الأمد عبر مجالي الرياضيات وعلوم الحاسوب النظرية، مع توثيق الحجج بشكل رسمي باستخدام Lean. تمتد هذه النتائج لتشمل الهندسة متعددة الأبعاد، ونظرية الترميز، ونظرية الزمر، والتعقيد الكمي، حيث عالجت أسئلة لم تشهد أي تقدم لمدة عشر سنوات على الأقل.

lab NVIDIA Research · منذ 5 ساعة · مشاهدة واحدة

يستخدم HorizonRelight التكييف الذاتي المقنع لإعادة الإضاءة المتسقة للفيديو طويل المدى

يتناول الباحثون الانقطاعات الزمنية في إعادة إضاءة الفيديو طويل المدى عن طريق إعادة صياغة المهمة على أنها ترجمة مجال كامن مشروط زمنيًا. يفرض الإطار استمرارية عبر القطع عن طريق نشر كميات المجال المستهدف عبر الحدود ويستخدم التكييف الذاتي المقنع للمجال المستهدف لجعل هذا السلوك قابلاً للتعلم.

lab NVIDIA Research · منذ 3 يوم · 38 مشاهدة

تساوي نماذج اللغات الكبيرة أو تتفوق على التحسين البايزي في تحسين المعاملات الفائقة

تستكشف ورقة بحثية جديدة استخدام نماذج لغوية كبيرة أساسية (LLMs) لأتمتة تحسين المعاملات الفائقة (HPO)، وهي عملية تعتمد عادةً على أساليب يدوية في إعدادات الميزانية المحدودة. طور المؤلفون منهجية تقترح فيها النماذج LLM تكوينات للمعاملات الفائقة بناءً على وصف مجموعة البيانات والنموذج، والتي يتم بعد ذلك تحسينها تكرارياً وفقًا لأداء النموذج.

lab NVIDIA Research · منذ 3 يوم · 40 مشاهدة

مصدر يقدم اشتقاقًا مقاربًا غير ملتوي لنسبة بيانات التدريب

يقدم الباحثون مصدر، وهو طريقة جديدة لنسبة بيانات التدريب (TDA) تجمع بين الكفاءة الحسابية لدوال التأثير ودقة النهج القائمة على التفكيك. باستخدام صيغة تشبه دالة التأثير لتقريب الاشتقاق غير الملتوي، يعالج مصدر قيود طرق الاشتقاق الضمني، مثل فشلها في حساب التحيز الأمثل أو خطوط الأنابيب متعددة المراحل.

lab NVIDIA Research · منذ 3 يوم · 10 مشاهدات

إنفيديا تطلق نموذج العالم التوليدي في الوقت الفعلي OmniDreams لمحاكاة المركبات ذاتية القيادة

أعلنت إنفيديا عن إطلاق OmniDreams، وهو نموذج عالمي توليدي أساسي صُمم لمعالجة الاختناقات في تقييم سياسات القيادة الذاتية ضمن المحاكاة الحلقية المغلقة. تم تدريبه في مرحلتي ما قبل وبعد التدريب باستخدام نموذج Cosmos الانتشاري على 21k ساعة من سيناريوهات القيادة، حيث يولد مقاطع فيديو مشروطة بالإجراءات بشكل تسلسلي ذاتي وفي الوقت الفعلي.

lab NVIDIA Research · منذ 3 يوم · 9 مشاهدات

تتعلم JacNet الدوال عن طريق نمذجة جاكوبيان المهيكلة مباشرة

يقدم الورقة JacNet، وهو بنية شبكة عصبية تتعلم بشكل مباشر جاكوبيان لدالة الإدخال-الإخراج بدلاً من التحويل نفسه. يتيح هذا النهج تحكماً دقيقاً في خصائص المشتق، مما يمكّن من فرض مسبق هيكلي مثل القابلية للعكس والاستمرارية k-Lipschitz.

lab Microsoft Research Blog · منذ 3 يوم · 11 مشاهدة

أبحاث مايكروسوفت تقدم CARE-X، نموذج رؤية ولغة موحد لأشعة الصدر مع إشراف مساعد وقياس مدعوم بالأدوات

قدمت أبحاث مايكروسوفت CARE-X، وهو نموذج بحثي مصمم لسد الفجوات في نماذج الرؤية واللغة الحالية في مجال الأشعة من خلال الجمع بين كتابة التقارير التوليدية والتنبؤات التشخيصية المعايرة. يستخدم النظام التعلم التعزيزي (DAPO) لمكافأة الدقة السريرية، ويقوم بربط نموذج Qwen3-VL-4B-Instruct بأدوات قياس حتمية لتقييم الأداء على الحالات التي تتطلب حسابات دقيقة.

lab NVIDIA Research · منذ 4 يوم · 6 مشاهدات

Masters يُكثّف نماذج الرؤية واللغة عبر قناع المعلم وتعزيز الطالب

يقترح الباحثون Masters، وهو إطار تعلم بالتعزيز التدريجي بالقناع لتكثيف نماذج الرؤية واللغة واسعة النطاق إلى إصدارات مدمجة مناسبة للنشر على الحافة. تتناول الطريقة عدم الاستقرار الناتج عن فجوة الحجم بين نموذجي المعلم والطالب.

lab NVIDIA Research · منذ 4 يوم · 14 مشاهدة

يخفف DSTP من فشل تقليم الرموز البصرية في الاستدلال المعقد لنماذج MLLM

حدد الباحثون تحول المعلومات البصرية ذات الصلة (RVIS) أثناء فك التشفير كسبب رئيسي لفشل طرق تقليم الرموز البصرية الحالية في نماذج اللغة الكبيرة متعددة الوسائط (MLLMs). ولمعالجة ذلك، يقترحون تقليم الرموز الواعي بالتحول في مرحلة فك التشفير (DSTP)، وهو إطار عمل لا يتطلب التدريب يقوم بمحاذاة الرموز البصرية مع متطلبات الاستدلال المتغيرة.

lab NVIDIA Research · منذ 4 يوم · 3 مشاهدات

يقوم GenRecal بتقطير نماذج الرؤية واللغة الكبيرة إلى صغيرة عبر إعادة معايرة

يقدم الباحثون GenRecal، وهو إطار عمل لتقطير الأغراض العامة ينقل المعرفة من نماذج الرؤية واللغة الكبيرة (VLM) إلى نظائرها الأصغر والأكثر كفاءة. تتناول الطريقة تحدي معماريات VLM غير المتجانسة باستخدام مُعيد معايرة لمحاذاة وتكييف تمثيلات الميزات عبر أنواع النماذج المختلفة.

lab NVIDIA Research · منذ 4 يوم · 9 مشاهدات

يستخدم ZPPO المطالبات بدلاً من التدرجات لتحسين تدريب نماذج الرؤية واللغة الصغيرة

يقدم الباحثون منطقة تحسين السياسة القريبة (ZPPO)، وهي طريقة تُدخل معرفة المعلم في المطالبات بدلاً من تدرجات السياسة لمعالجة الهشاشة في تقطير المعرفة والانحراف في التعلم المعزز. يبني ZPPO أسئلة تتضمن مرشحين ثنائيين (BCQ) وأسئلة تتضمن مرشحين سلبيين (NCQ) للأسئلة الصعبة، ويعيد تدويرها عبر مخزن الاسترجاع حتى تتحسن دقة الطالب أو يتم إخراجها.

lab NVIDIA Research · منذ 4 يوم

Hide to See تقدم قناع بادئة الاستدلال لتقطير VLM

يقترح الباحثون إطار عمل جديد لتقطير التفكير-الإجابة يحسن قدرة النماذج اللغوية البصرية المدمجة على استخدام الأدلة المرئية من خلال قناع بادئات الاستدلال البارزة. يعالج هذا النهج مشكلة "النسيان البصري" الشائعة في مسارات التفكير-الإجابة الطويلة، حيث يفقد الطلاب التركيز على الإشارات المرئية أثناء الاستدلال المطول.

lab NVIDIA Research · منذ 4 يوم · مشاهدة واحدة

يستخدم SpatialClaw الكود كواجهة إجراء للاستدلال المكاني الوكيل

يقترح الباحثون SpatialClaw، إطار عمل خالٍ من التدريب يعتمد على الكود كواجهة إجراء لتحسين الاستدلال المكاني المفتوح 3D و4D في نماذج الرؤية واللغة. على عكس الوكلاء الحاليين الذين يعتمدون على التنفيذ ذو المرور الواحد أو استدعاءات الأدوات الجامدة، يحافظ SpatialClaw على نواة Python ذات حالة محملة مسبقاً بإطارات الإدخال ومبادئ الاستيعاب.

lab NVIDIA Research · منذ 4 يوم · مشاهدتان

تحسّن AXPO للاستدلال الوكيل متعدد الوسائط عبر سد فجوة التفكير-التنفيذ

يقترح الباحثون تحسين سياسة الاستكشاف الوكيل (AXPO) لمعالجة "فجوة التفكير-التنفيذ" في نماذج اللغة والرؤية التي تتطلب أدوات خارجية. تسبب هذه الفجوة في محاولة طرق التعزيز المعيارية مثل GRPO استخدام الأدوات في حوالي 30% فقط من عمليات الرولأوت، مع كبت إشارات التعلم بسبب معدلات الفشل العالية.

lab NVIDIA Research · منذ 9 يوم · 11 مشاهدة

تحسين إنتاجية المصنع بنسبة تصل إلى 12.06 مرة عبر تقديم مجموعة GPU مشتركة باستخدام ROSA

يقترح الباحثون نظام تقديم نماذج أساسية للروبوتات يُدعى ROSA، مصمم لمصانع الروبوتات ويتجاوز افتراضات الحوسبة الطرفية لروبوت واحد. يستخدم النظام تقديم مجموعة GPU المشتركة للسماح لأساطيل الروبوتات بالوصول إلى وحدات معالجة الرسومات من فئة الخوادم عبر الشبكة.

lab NVIDIA Research · منذ 18 يوم · 7 مشاهدات

تحليل الذكاء الاصطناعي متعدد الوسائط للتواصل غير اللفظي في دلتا فورس

يقوم الباحثون بتحليل مقاطع فيديو اللعب من لعبة التصويب التنافسية دلتا فورس لاستخراج وفهم التواصل غير اللفظي الناشئ، مثل الإيماءات وأنماط الحركة. يتناول هذا العمل فجوة في الدراسات السابقة التي ركزت بشكل كبير على ألعاب MOBA أو التنسيق اللفظي في ألعاب التصويب الأخرى.

lab NVIDIA Research · منذ 18 يوم · مشاهدة واحدة

باحثو إنفيديا يقترحون تجارب ميدانية في بطولات روكيت ليغ

يعالج باحثو إنفيديا صعوبة جدولة اللعب الجماعي التنافسي وإعادة إنشاء بيئات المختبر من خلال اعتماد منهجية التجارب الميدانية. يدمج هذا النهج التجارب مباشرةً في هياكل البطولات، مما يخلق بطولات-تجارب هجينة.

lab NVIDIA Research · منذ 21 يوم · مشاهدة واحدة

إطار عمل AITE يكتشف خوارزميات لاسلكية بشكل مستقل عبر بحث مدفوع بـ LLM

يقدم الباحثون The AI Telco Engineer (AITE)، وهو إطار عمل يستخدم البحث التطوري المدعوم بنماذج لغوية كبيرة لتصميم الخوارزميات بشكل مستقل لمشاكل الاتصالات المعقدة مع التنقل بين مقايضات الأداء والتعقيد.

media Don't Worry About the Vase · منذ 11 يوم · 5 مشاهدات

أسترا من أوبن إيه آي تحل 10 مسائل رياضية مفتوحة كبرى

أطلقت أوبن إيه آي نتائج نموذجها الداخلي غير المُصدر، أسترا، الذي نجح في حل عشرة مسائل مفتوحة مهمة في الرياضيات. تم توليد الحلول بواسطة النموذج ثم صاغها باحثون بشريون إلى شهادات لين (Lean).