Проект llama.cpp выпустил сборку b10889, которая включает оптимизацию памяти для избежания выделения V кэша для индексатора, поскольку он не используется.

Это обновление предоставляет предварительно собранные бинарные файлы для macOS (Apple Silicon и Intel), iOS, Linux (Ubuntu x64, arm64, s390x с CPU, Vulkan, ROCm 10.0, OpenVINO и SYCL бэкендами), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0) и openEuler.

Релиз также включает UI llama.cpp.