Le projet llama.cpp a publié la compilation b10231, introduisant le support pour le sidecar de décodage spéculatif DSpark. Cette mise à jour permet aux fichiers dspark d'être résolus de manière similaire aux autres sidecars spéculatifs, avec le tag -hfd appliqué à ceux-ci et la sélection automatique privilégiant dspark par rapport à dflash en raison de sa tête Markov supplémentaire.
La version fournit des binaires pour macOS (Apple Silicon et Intel), iOS, Linux (Ubuntu x64, arm64, s390x avec CPU, Vulkan, ROCm 7.2, OpenVINO et backends SYCL), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP) et openEuler (x86 et aarch64 avec ACL Graph).
Cette mise à jour élargit les options d'accélération matérielle disponibles pour les utilisateurs de llama.cpp sur plusieurs systèmes d'exploitation et architectures GPU.