Le projet llama.cpp a publié la version b11073, qui inclut une modification du backend SYCL. Cette mise à jour regroupe les chargements softmax de MKL-FA au lieu d'assigner un work-item par ligne.

  • La release fournit des binaires pour macOS (Apple Silicon et Intel), Linux (Ubuntu avec CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO et SYCL FP32/FP16), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0), Android et openEuler.
  • Un iOS XCFramework est également inclus dans la distribution.

Les notes de release ne spécifient pas d'améliorations de performance ou d'avantages pour les utilisateurs pour ce changement.