Le projet llama.cpp a publié la version b10638, qui implémente le support de Vulkan pour les fonctions `cross_entropy_loss` et `cross_entropy_loss_back`.

  • La publication inclut des binaires préconstruits pour macOS (Apple Silicon et Intel), Linux (Ubuntu x64, arm64, s390x), Windows (x64 et arm64), Android (arm64) et openEuler.
  • L'accélération GPU est disponible via Vulkan, CUDA (12.4, 13.3, 13.4 preview), ROCm 7.14, OpenCL Adreno, SYCL et OpenVINO sur les plateformes prises en charge.
  • Les builds macOS Apple Silicon avec KleidiAI sont actuellement désactivés dans cette publication.
  • Un package d'interface utilisateur mis à jour est également fourni aux côtés des binaires principaux.