أصدر مشروع vLLM الإصدار 0.29.0، والذي يتضمن إصلاحًا رئيسيًا للخطأ المتعلق بالتخزين المؤقت للكثيف.
- يطبق التحديث إعداد التخزين المؤقت للكثيف الافتراضي بشكل خاص للنماذج الهجينة.
أصدر مشروع vLLM الإصدار 0.29.0، والذي يتضمن إصلاحًا رئيسيًا للخطأ المتعلق بالتخزين المؤقت للكثيف.
أصدر مشروع llama.cpp الإصدار b10891، الذي يعالج مشكلة استقرار حرجة على وحدات معالجة الرسومات PowerVR. يعدل التحديث الخلفية Vulkan للرجوع إلى اختزال الذاكرة المشتركة لعمليات ضرب المصفوفة المتجهية بعد فك التكميم (dmmv).
أعلنت ديب سيك أيه آي عن إطلاق DeepSeek-V4.1-Flash، وهو نموذج مختلط الخبراء متعدد الوسائط يتميز بنافذة سياق تتكون من مليون رمز وتخزين مؤقت KV بدقة FP4 يقلل من حجم التخزين المؤكي العالمي إلى 890 بايت لكل رمز. يعتمد النموذج على بنية مشفر-مفكك سببية وCompressed Sparse Attention 2 (CSA2) لخفض متطلبات الذاكرة بشكل كبير مع الحفاظ على الأداء.
أصدر مشروع llama.cpp الإصدار b10889، والذي يتضمن تحسينًا للذاكرة لتجنب تخصيص ذاكرة التخزين المؤقت V للمؤشر نظرًا لأنه غير مستخدم.
أصدر مشروع llama.cpp الإصدار b10888، والذي يتضمن ميزة جديدة لإضافة علامات تصحيح أخطاء مخزن الأوامر لمحللات GPU في الخلفية Vulkan.
أصدر مشروع llama.cpp الإصدار b10886، الذي يقدم دعم الضمادات المتجهة Q1_0 لهندسة s390x. يتضمن هذا التحديث تنفيذ `ggml_vec_dot_q1_0_q8_0` وتحديث الوثائق لتعكس القدرة الجديدة.
نستخدم ملفات تعريف الارتباط لقياس الزيارات وتحسين الموقع. يمكنك قبول أو رفض ملفات تعريف الارتباط الخاصة بالتحليلات. سياسة الخصوصية