أطلق مشروع llama.cpp الإصدار b11035، مقدمًا دعمًا لنوى ضرب المصفوفات IQ3_S MMQ في الخلفية الخاصة بـ Vulkan.
- تتضمن التحديث نوى جديدة لـ IQ3_S MMQ matmul لـ Vulkan.
- يقوم Block_a_to_shmem الآن بتحميل بيانات بحجم 2 بايت لتحسين الوصول إلى الذاكرة.
- تم تعديل فحوصات المحاذاة حيث يستخدم IQ3_S حجم البلاطة K.
- تتوفر الملفات الثنائية لأنظمة macOS و Linux و Windows و Android و openEuler عبر منصات CPU و CUDA و ROCm و OpenVINO و SYCL و OpenCL.
يوفر هذا الإصدار ملفات ثنائية محدثة لأنظمة تشغيل متعددة ومسرعات الأجهزة، مما يتيح للمستخدمين الاستفادة من دعم الكوانتيزيشن الجديد لـ Vulkan.