O projeto llama.cpp lançou a versão b10589, que introduz o suporte a CUDA POOL_1D por meio do pull request #27573. Esta atualização também inclui uma correção para conformidade com editorconfig, adicionando uma nova linha final ausente.
O lançamento fornece binários para macOS (Apple Silicon e Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Windows (x64 e arm64) e Android. Os backends suportados incluem CPU, CUDA 12/13, Vulkan, ROCm 7.14, OpenVINO, SYCL e OpenCL Adreno.
Este lançamento permite que os usuários executem o llama.cpp em uma ampla gama de arquiteturas de hardware e sistemas operacionais com a nova capacidade de pooling.