أصدر مشروع llama.cpp الإصدار b11310، الذي يتضمن إصلاحًا لمنطق فك التكمية IQ4_NL للخلفية CUDA. يعالج التحديث مشكلة أمان الذاكرة حيث يمكن للخيوط القراءة والكتابة بعد نهاية الصف عند معالجة كتل أقصر من QK_K.

  • يحمي نواة فك تكمية الصف iq4_nl ضد الصفوف القصيرة عن طريق تخطي الكتل الفرعية التي تبدأ عند أو بعد طول الصف.
  • يوفر ثنائيات جاهزة لـ macOS (Apple Silicon و Intel) و Linux و Windows و Android و openEuler عبر خلفيات CPU و CUDA و Vulkan و ROCm و OpenVINO و SYCL و Snapdragon.

يمنع هذا الإصلاح الوصول إلى الذاكرة خارج الحدود المحتمل أثناء الاستدلال باستخدام نماذج مكممة بـ IQ4_NL على أجهزة CUDA.