Le projet llama.cpp a publié la compilation b10692, qui inclut une modification de l'implémentation SYCL pour l'opération TOP_K. Le changement consiste à diviser les longues lignes au sein du noyau plutôt qu'à attribuer un groupe de travail par ligne.
Cette mise à jour est disponible sur plusieurs plateformes et backends matériels, y compris macOS (Apple Silicon et Intel), Linux (CPU, Vulkan, ROCm 7.14, OpenVINO et SYCL FP32/FP16), Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL et ROCm 7.14), Android et iOS.
La version fournit des binaires pour diverses architectures telles que x64, arm64 et s390x, ainsi qu'un package d'interface utilisateur mis à jour.