Proyek llama.cpp telah merilis versi b11460, yang memperkenalkan dukungan untuk format kuantisasi IQ3_S multi-column MMVQ di backend SYCL-nya. Pembaruan ini disertakan dalam build baru bersama dengan opsi akselerasi CPU dan GPU standar.
- Rilis menambahkan dukungan IQ3_S multi-column MMVQ ke implementasi SYCL melalui pull request #29500.
- Binari disediakan untuk macOS (Apple Silicon dan Intel), Linux (x64, arm64, s390x), Windows, Android, dan openEuler.
- Akselerasi GPU tersedia melalui CUDA 12/13, Vulkan, ROCm 10.0, OpenVINO, dan OpenCL Adreno di platform yang didukung.
- Build spesifik disertakan untuk perangkat Snapdragon di Linux dan Android, mendukung CPU, GPU Adreno, dan NPU Hexagon.
Rilis ini memungkinkan pengguna mengakses optimasi SYCL terbaru dan memperluas kompatibilitas perangkat keras untuk menjalankan model llama.cpp pada berbagai arsitektur.