O projeto llama.cpp lançou a versão b10505, que introduz uma nova opção de preset `dedup-cache-models` para o componente do servidor.
- O lançamento inclui binários para macOS (Apple Silicon e Intel), Linux (Ubuntu x64, arm64, s390x, Vulkan, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm) e openEuler.
- O suporte ao KleidiAI para macOS Apple Silicon está desativado nesta compilação.
- O suporte ao Ubuntu x64 ROCm 7.14 também está desativado.
- Um novo pacote de interface do usuário está disponível para download junto com os binários específicos da plataforma.