Proyek llama.cpp telah merilis versi b10589, yang memperkenalkan dukungan CUDA POOL_1D melalui pull request #27573. Pembaruan ini juga mencakup perbaikan kepatuhan editorconfig dengan menambahkan baris baru akhir yang hilang.

Rilis ini menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Windows (x64 dan arm64), dan Android. Backend yang didukung meliputi CPU, CUDA 12/13, Vulkan, ROCm 7.14, OpenVINO, SYCL, dan OpenCL Adreno.

Rilis ini memungkinkan pengguna menjalankan llama.cpp di berbagai arsitektur perangkat keras dan sistem operasi dengan kemampuan pooling baru.