Proyek llama.cpp telah merilis versi b10926, yang mencakup perbaikan untuk menangani kuantisasi tq1_0 yang tidak didukung dengan cara gagal secara lancar. Pembaruan ini mengatasi isu #28681 untuk meningkatkan stabilitas saat menemui format kuantisasi spesifik ini.

Rilis ini menyediakan biner untuk macOS (Apple Silicon dan Intel), Linux (Ubuntu dengan backend CPU, Vulkan, ROCm 10.0, OpenVINO, dan SYCL), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, dan ROCm 10.0), serta arsitektur openEuler.

Pembaruan ini memastikan bahwa pengguna dapat terus menggunakan llama.cpp tanpa mengalami crash saat model memanfaatkan skema kuantisasi tq1_0.