O projeto llama.cpp lançou a versão b10505, que introduz uma nova opção de preset `dedup-cache-models` para o componente do servidor.

  • O lançamento inclui binários para macOS (Apple Silicon e Intel), Linux (Ubuntu x64, arm64, s390x, Vulkan, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm) e openEuler.
  • O suporte ao KleidiAI para macOS Apple Silicon está desativado nesta compilação.
  • O suporte ao Ubuntu x64 ROCm 7.14 também está desativado.
  • Um novo pacote de interface do usuário está disponível para download junto com os binários específicos da plataforma.