O projeto llama.cpp lançou a versão b11047, que inclui uma correção crítica para a corrupção do CUB argsort causada por chaves in-place. O problema surgiu porque `argsort_f32_i32_cuda_cub` chamou `DeviceRadixSort::SortPairs` com buffers de chave de entrada e saída aliasados, fazendo com que o ping-pong de double-buffer interno do CUB sobrescrevesse sua própria entrada durante a passagem.

Este bug resultou em permutações corrompidas e índices lixo intermitentes, particularmente em GPUs Maxwell com CUDA 12.5 e CCCL 2.x, o que subsequentemente disparou gathers fora de limites nas operações `get_rows` downstream. A correção garante que todos os seis pontos de chamada (plain e segmented, ascending e descending, size-query e execute) usem buffers keys-out distintos.

O lançamento fornece binários para macOS, Linux, Android, Windows e openEuler através dos backends CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL e OpenCL.