أطلق مشروع llama.cpp الإصدار b11035، مقدمًا دعمًا لنوى ضرب المصفوفات IQ3_S MMQ في الخلفية الخاصة بـ Vulkan.

  • تتضمن التحديث نوى جديدة لـ IQ3_S MMQ matmul لـ Vulkan.
  • يقوم Block_a_to_shmem الآن بتحميل بيانات بحجم 2 بايت لتحسين الوصول إلى الذاكرة.
  • تم تعديل فحوصات المحاذاة حيث يستخدم IQ3_S حجم البلاطة K.
  • تتوفر الملفات الثنائية لأنظمة macOS و Linux و Windows و Android و openEuler عبر منصات CPU و CUDA و ROCm و OpenVINO و SYCL و OpenCL.

يوفر هذا الإصدار ملفات ثنائية محدثة لأنظمة تشغيل متعددة ومسرعات الأجهزة، مما يتيح للمستخدمين الاستفادة من دعم الكوانتيزيشن الجديد لـ Vulkan.