Proyek llama.cpp merilis build b10231, memperkenalkan dukungan untuk sidecar decoding spekulatif DSpark. Pembaruan ini memungkinkan file dspark diselesaikan secara serupa dengan sidecar spekulatif lainnya, dengan tag -hfd diterapkan pada mereka dan pemilihan otomatis memprioritaskan dspark daripada dflash karena Markov head tambahan.

Rilis ini menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (Ubuntu x64, arm64, s390x dengan CPU, Vulkan, ROCm 7.2, OpenVINO, dan backend SYCL), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP), dan openEuler (x86 dan aarch64 dengan ACL Graph).

Pembaruan ini memperluas opsi akselerasi perangkat keras yang tersedia bagi pengguna llama.cpp di berbagai sistem operasi dan arsitektur GPU.