Proyek llama.cpp telah merilis build b10447, yang mencakup desain ulang model utas `yield_to_queue`. Perubahan ini melibatkan menjalankan `common_speculative_process` di worker dan menukar desain utas worker ke utama.

Rilis ini menyediakan biner untuk macOS (Apple Silicon dan Intel), Linux (Ubuntu dengan CPU, Vulkan, OpenVINO, SYCL, dan ROCm dinonaktifkan), Android, Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, dan ROCm 7.14), dan openEuler (dengan beberapa build dinonaktifkan).

Pembaruan ini tersedia untuk diunduh di semua platform yang didukung.