أصدر مشروع llama.cpp الإصدار b11390، والذي يتضمن إصلاحًا لخطأ ذاكرة CUDA MMQ الذي حدث عندما كان عدد الخبراء أكبر بكثير من حجم الدفعة الدقيقة.

  • يحل خطأ ذاكرة في الخلفية الخلفية لـ CUDA المتعلق بمعالجة Mixture-of-Experts (MMQ).
  • يوفر ملفات قابلة للتنفيذ لأنظمة macOS (Apple Silicon و Intel)، و Linux (CPU، Vulkan، CUDA 12/13، ROCm، OpenVINO، SYCL، Snapdragon)، و Windows (CPU، OpenCL، CUDA 12/13، Vulkan، OpenVINO، SYCL، ROCm)، و Android، و openEuler.
  • يتضمن إصدارًا محدثًا لواجهة المستخدم.

يضمن هذا التحديث الاستقرار للمستخدمين الذين يشغلون نماذج Mixture-of-Experts على عتاد CUDA من خلال منع خطأ الوصول المحدد للذاكرة.