Le projet llama.cpp a publié la version b10589, qui introduit le support CUDA POOL_1D via la pull request #27573. Cette mise à jour inclut également une correction pour la conformité editorconfig en ajoutant une nouvelle ligne finale manquante.

La release fournit des binaires pour macOS (Apple Silicon et Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Windows (x64 et arm64) et Android. Les backends pris en charge incluent CPU, CUDA 12/13, Vulkan, ROCm 7.14, OpenVINO, SYCL et OpenCL Adreno.

Cette release permet aux utilisateurs d'exécuter llama.cpp sur une large gamme d'architectures matérielles et de systèmes d'exploitation grâce à la nouvelle capacité de pooling.