Le projet llama.cpp a publié la version b10356, qui cible principalement l'infrastructure de compilation en passant le backend ROCm de la version 7.2.1 à 7.14. Cette mise à jour s'aligne sur ROCm 7.14 étant la première version de production utilisant le système de build TheRock et implique la migration des tâches CI pour utiliser des wheels multi-architectures tant sous Linux que sous Windows.

  • Change la cible ROCm de 7.2.1 à 7.14 sur les builds Linux et Windows.
  • Migre les actions de configuration partagées de Windows vers des wheels ROCm multi-architectures et met à jour build-cuda-windows.yml en conséquence.
  • Ajoute de nouveaux binaires Windows pour CUDA 13 (x64) et un support preview pour CUDA 13.4 (arm64).
  • Fournit des binaires précompilés pour macOS (Apple Silicon et Intel), Linux (CPU, Vulkan, OpenVINO, SYCL), Android et iOS.

Cette version garantit la compatibilité avec la dernière infrastructure ROCm tout en élargissant les options d'accélération GPU sous Windows grâce aux versions plus récentes de CUDA.