أصدر مشروع llama.cpp الإصدار b11460، الذي يقدم دعمًا لتنسيق الكمية IQ3_S multi-column MMVQ داخل الخلفية SYCL الخاصة به. يتم تضمين هذا التحديث في البناء الجديد جنبًا إلى جنب مع خيارات تسريع CPU و GPU القياسية.

  • يضيف الإصدار دعم IQ3_S multi-column MMVQ إلى تنفيذ SYCL عبر طلب السحب #29500.
  • يتم توفير ملفات ثنائية لأنظمة macOS (Apple Silicon و Intel)، و Linux (x64، arm64، s390x)، و Windows، و Android، و openEuler.
  • تسريع GPU متاح عبر CUDA 12/13، و Vulkan، و ROCm 10.0، و OpenVINO، و OpenCL Adreno على المنصات المدعومة.
  • يتم تضمين إصدارات محددة لأجهزة Snapdragon على Linux و Android، وتدعم CPU، و GPU Adreno، و NPU Hexagon.

يتيح هذا الإصدار للمستخدمين الوصول إلى أحدث تحسينات SYCL ويوسع توافق الأجهزة لتشغيل نماذج llama.cpp على بنية متنوعة.