Le projet llama.cpp a publié la version b10738, fournissant des binaires pour macOS, Linux, Windows, Android et openEuler sur CPU, GPU et divers backends d'accélérateurs.

  • La release inclut une mise à jour spécifique du support SYCL qui limite la mémoire d'allocation maximale à 2 Go pour la mémoire fixe hôte.
  • Les builds macOS Apple Silicon avec KleidiAI sont désactivés dans cette version.
  • Le support preview de CUDA 13 pour Windows arm64 est inclus.
  • Les binaires ROCm 7.14 et OpenVINO 2026.3.1 sont disponibles pour Ubuntu et Windows.

Cette mise à jour permet aux utilisateurs d'accéder aux dernières fonctionnalités de llama.cpp sur le matériel pris en charge, avec une attention particulière aux contraintes de mémoire dans les implémentations SYCL.