أصدر مشروع llama.cpp الإصدار b11195، الذي يقدم تنفيذًا لعملية ضرب المصفوفات المقسمة إلى مربعات لكميات k في الخلفية المعالجة بالوحدة المركزية. يفك هذا التغيير البيانات المُكمّاة إلى مربعات بحجم 256x256 من النوع int8 ويحسب النتائج باستخدام نوى دقيقة لتحسين الأداء في عمليات المصفوفات الكبيرة.

  • يوفر ضرب المصفوفات المقسمة إلى مربعات تسريعًا بمقدار 3-6 أضعاف لعمليات الضرب للمصفوفات الكبيرة، مع نقطة التعادل عند أبعاد 4096x64 * 64x4096.
  • تبقى معدلات الخطأ ضئيلة، حيث تصل الأخطاء القصوى إلى حوالي 1-e04 وRMSE إلى حوالي 1-e05.
  • يتضمن الإصدار إصلاحات لعمليات البناء على ARM ونظام Windows، ودعم موحد لمعايير IQP لكميات Q5_K وIQ4_XS، ونوى AVX2 المُحسّنة.

يُحسّن التحديث سرعة الاستدلال لعمليات المصفوفات الكبيرة مع الحفاظ على الدقة العددية عبر المنصات المدعومة.