llama.cpp 프로젝트는 in-place 키로 인한 CUB argsort 손상에 대한 중요한 수정을 포함한 버전 b11047을 출시했습니다. 이 문제는 `argsort_f32_i32_cuda_cub`가 별칭화된 입력 및 출력 키 버퍼로 `DeviceRadixSort::SortPairs`를 호출하여 CUB의 내부 이중 버퍼링 ping-pong이 패스 중에 자체 입력을 덮어쓰기 때문에 발생했습니다.

이 버그는 특히 CUDA 12.5 및 CCCL 2.x가 있는 Maxwell GPU에서 손상된 순열과 간헐적인 가짜 인덱스를 초래했으며, 이는 후속적으로 다운스트림 `get_rows` 작업에서 경계 밖 수집을 트리거했습니다. 수정은 모든 여섯 호출 사이트(일반 및 분할, 오름차순 및 내림차순, 크기 쿼리 및 실행)가 서로 다른 keys-out 버퍼를 사용하도록 보장합니다.

이 릴리스는 CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL 및 OpenCL 백엔드를 위한 macOS, Linux, Android, Windows 및 openEuler용 바이너리를 제공합니다.