O projeto llama.cpp lançou a versão b10356, que tem como foco principal a infraestrutura de compilação, alterando o backend ROCm da versão 7.2.1 para 7.14. Esta atualização está alinhada com o ROCm 7.14 sendo o primeiro lançamento de produção utilizando o sistema de compilação TheRock e envolve a migração dos trabalhos de CI para usar wheels multi-arquitetura tanto para Linux quanto para Windows.

  • Altera o alvo do ROCm de 7.2.1 para 7.14 em compilações para Linux e Windows.
  • Migra ações compartilhadas de configuração do Windows para wheels ROCm multi-arquitetura e atualiza o build-cuda-windows.yml conforme necessário.
  • Adiciona novos binários para Windows para CUDA 13 (x64) e suporte preview para CUDA 13.4 (arm64).
  • Fornece binários pré-compilados para macOS (Apple Silicon e Intel), Linux (CPU, Vulkan, OpenVINO, SYCL), Android e iOS.

Este lançamento garante compatibilidade com a infraestrutura mais recente do ROCm enquanto expande as opções de aceleração de GPU no Windows por meio de versões mais recentes do CUDA.