تقدم إصدار b11413 من llama.cpp تنفيذًا جديدًا للانتباه الفلاش المتناثر عبر Vulkan يدعم موترات المفتاح والقيمة المُكمَّاة. يعالج هذا التحديث مشكلات الأداء في طريقة الانضغاط السابقة، التي كانت مكلفة للغاية لمهام فك التشفير ذات نوافذ السياق الكبيرة.
- يقسم النهج الجديد الصفوف إلى مقاطع متصلة تُعالَج بواسطة مجموعات فرعية أو خيوط، باستخدام عد التصويت على التحميلات المتجمعة للحفاظ على قائمة فهرس تصاعدية.
- تتوفر الثنائيات المُعدة مسبقًا لأنظمة macOS (Apple Silicon وIntel)، وLinux (CPU، Vulkan، CUDA 12/13، ROCm، OpenVINO، SYCL، Snapdragon)، وWindows (CPU، Vulkan، CUDA، OpenVINO، SYCL، ROCm)، وAndroid، وiOS.
- يتضمن الإصدار أيضًا واجهة المستخدم لـ llama.cpp وشهادات التحقق من الأمان.