Проект llama.cpp выпустил версию b10926, которая включает исправление для корректной обработки неподдерживаемых квантований tq1_0 путем безопасного завершения работы. Это обновление решает проблему #28681, улучшая стабильность при работе с данным форматом квантования.

Выпуск предоставляет бинарные файлы для macOS (Apple Silicon и Intel), Linux (Ubuntu с CPU, Vulkan, ROCm 10.0, OpenVINO и SYCL), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL и ROCm 10.0) и архитектур openEuler.

Это обновление гарантирует, что пользователи могут продолжать использовать llama.cpp без сбоев при использовании моделей, применяющих схему квантования tq1_0.