Proyek llama.cpp merilis versi b11047, yang mencakup perbaikan kritis untuk korupsi CUB argsort yang disebabkan oleh kunci in-place. Masalah ini muncul karena `argsort_f32_i32_cuda_cub` memanggil `DeviceRadixSort::SortPairs` dengan buffer kunci input dan output yang alias, menyebabkan ping-pong double-buffer internal CUB menimpa inputnya sendiri selama proses.

Bug ini mengakibatkan permutasi yang rusak dan indeks sampah intermiten, khususnya pada GPU Maxwell dengan CUDA 12.5 dan CCCL 2.x, yang selanjutnya memicu gathers out-of-bounds dalam operasi `get_rows` downstream. Perbaikan memastikan bahwa semua enam titik panggilan (plain dan segmented, ascending dan descending, size-query dan execute) menggunakan buffer keys-out yang berbeda.

Rilis ini menyediakan biner untuk macOS, Linux, Android, Windows, dan openEuler melalui backend CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL, dan OpenCL.