الموضوع · Inference efficiency
lab OpenAI News · منذ 28 يوم · 21 مشاهدة

OpenAI تقترح بطاقة تقييم "ذكاء مفيد لكل دولار" لقياس قيمة الذكاء الاصطناعي

توضح OpenAI إطار عمل يُسمى "ذكاء مفيد لكل دولار" لمساعدة الشركات على قياس القيمة الاقتصادية لاستثماراتها في الذكاء الاصطناعي بما يتجاوز مقاييس التكلفة البسيطة لكل توكن. يجادل المقال بأنه ينبغي قياس النجاح من خلال العمل المنجز، والموثوقية، والقابلية للتوسع بدلاً من معدلات التبني وحسب.

lab OpenAI News · منذ 1 يوم · مشاهدتان

OpenAI تعرض وضع Ultrafast لتشغيل GPT-5.6 Sol أسرع بـ 14 مرة

تطلق OpenAI نسخة تجريبية من Ultrafast، وهو مستوى خدمة جديد يعمل بنموذج GPT-5.6 Sol بسرعة تصل إلى 14 مرة أسرع من المعالجة القياسية. مدعومًا بأجهزة Cerebras، يولد هذا الوضع ما يصل إلى 750 رمز مخرج في الثانية وهو متاح في البداية عبر واجهة برمجة تطبيقات OpenAI.

lab NVIDIA Research · منذ 4 ساعة · مشاهدتان

إنفيديا تقدم FusionRelight لإعادة إضاءة البورتريه في الوقت الفعلي عبر دمج المعرفة الهجينة للمجال

قدم باحثو إنفيديا FusionRelight، وهي طريقة لإعادة إضاءة البورتريه تجمع بين نقل الإضاءة المادي المعقول والحفاظ على الهوية والاستدلال في الوقت الفعلي المضغوط. تستخدم هذه الطريقة دمج المعرفة الهجينة للمجال (HDKF)، وهو إطار تدريبي يستخلص مسبقاً من الفيزياء والانعكاسية والواقعية من البيانات الاصطناعية، وواحدة-ضوء-في-الوقت (OLAT)، والبيانات في البرية، لنموذج طالب.

lab NVIDIA Research · منذ 4 يوم · 14 مشاهدة

يخفف DSTP من فشل تقليم الرموز البصرية في الاستدلال المعقد لنماذج MLLM

حدد الباحثون تحول المعلومات البصرية ذات الصلة (RVIS) أثناء فك التشفير كسبب رئيسي لفشل طرق تقليم الرموز البصرية الحالية في نماذج اللغة الكبيرة متعددة الوسائط (MLLMs). ولمعالجة ذلك، يقترحون تقليم الرموز الواعي بالتحول في مرحلة فك التشفير (DSTP)، وهو إطار عمل لا يتطلب التدريب يقوم بمحاذاة الرموز البصرية مع متطلبات الاستدلال المتغيرة.

lab NVIDIA Research · منذ 18 يوم · 13 مشاهدة

تكميم دفتر أكوام متجمع لضغط الصور القائم على غاوس ثنائي الأبعاد

يقدم الباحثون تكميم المتجه الموجه بالعناقيد (CGVQ)، وهي طريقة مصممة لتحسين أداء معدل التشويه في ضغط الصور القائم على البدع الغاوسية. يقسم النهج معاملات غاوس إلى مجموعات متجانسة قبل التكميم، مما يعالج عدم الكفاءة الناتجة عن تخزين أعداد كبيرة من معاملات النقطة العائمة لكل بدعة.

media Latent Space · منذ 15 يوم · 16 مشاهدة

أوبن إيه آي تخفض أسعار GPT-5.6 بنسبة تصل إلى 80% عبر التحسين الذاتي

أعلنت أوبن إيه آي عن تخفيضات كبيرة في أسعار نماذجها GPT-5.6، مدفوعة بتحسينات منهجية في الكفاءة وتقنيات التحسين الذاتي التكراري. وتبلغ الشركة أن تكلفة الذكاء بمستوى GPT-5.4 انخفضت حوالي 13 مرة خلال أربعة أشهر، مع خفض أسعار GPT-5.6 Luna بنسبة 80% وTerra بنسبة 20%.

blog Simon Willison · منذ 15 يوم · 20 مشاهدة

OpenAI تخفض سعر GPT-5.6 Luna بنسبة 80% باستخدام Sol لتحسين الاستدلال

قمت OpenAI بخفض أسعار عائلة نماذج GPT-5.6 بشكل كبير، حيث أدخلت انخفاضاً هائلاً في السعر بنسبة 80% لـ GPT-5.6 Luna وانخفاضاً بنسبة 20% لـ GPT-5.6 Terra. تم تمكين هذه التغييرات بواسطة GPT-5.6 Sol، الذي يحسّن عملية المرور الأمامي للنموذج ونوى الإنتاج لتحسين الكفاءة.

github llama.cpp · منذ 15 ساعة · مشاهدة واحدة

دمج llama.cpp b10427 لعمليات FFN عبر SYCL لتحقيق زيادة في الإنتاجية تصل إلى 12.4%

أصدر مشروع llama.cpp الإصدار b10427، الذي يتضمن تحسينًا للأداء لوحات Intel Arc الرسومية عبر SYCL. يطبق التحديث دمج عمليات gate و up و GLU داخل طبقة الشبكة العصبية الأمامية الكثيفة (FFN) من نوع q4_K.