llama.cpp प्रोजेक्ट ने संस्करण b11047 जारी किया, जिसमें in-place कुंजियों द्वारा कारण CUB argsort क्षति के लिए एक महत्वपूर्ण सुधार शामिल है। यह समस्या इसलिए उत्पन्न हुई क्योंकि `argsort_f32_i32_cuda_cub` ने `DeviceRadixSort::SortPairs` को aliased इनपुट और आउटपुट कुंजी बफर के साथ कॉल किया, जिससे CUB का आंतरिक double-buffer ping-pong अपने आप में इनपुट को पार के दौरान ओवरराइट कर दिया।

इस बग के परिणामस्वरूप क्षतिग्रस्त permutations और अंतःक्रियात्मक garbage indices हुए, विशेष रूप से CUDA 12.5 और CCCL 2.x के साथ Maxwell GPUs पर, जिसके बाद downstream `get_rows` ऑपरेशन में out-of-bounds gathers ट्रिगर हुए। सुधार यह सुनिश्चित करता है कि सभी छह call sites (plain और segmented, ascending और descending, size-query और execute) अलग keys-out बफर का उपयोग करें।

रिलीज macOS, Linux, Android, Windows, और openEuler के लिए CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL, और OpenCL backends के लिए binaries प्रदान करती है।