llama.cpp 프로젝트는 CUDA에서 양자화된 복사 커널 실행 시 스레드 및 블록 수에 대한 수정을 포함한 버전 b10327을 출시했습니다. 이 업데이트는 pull request #26731에서 식별된 문제를 해결합니다.
- 정확성을 보장하기 위해 불균일한 블록 수 복사 사례에 대한 테스트가 릴리스에 추가되었습니다.
- macOS(Apple Silicon 및 Intel), Linux(CPU, Vulkan, ROCm 7.2, OpenVINO, SYCL), Android, Windows(CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP) 및 openEuler용 바이너리가 제공됩니다.
- iOS XCFramework와 독립형 UI 빌드도 제공됩니다.
이 릴리스는 광범위한 지원 플랫폼 전반에 걸쳐 CUDA 하드웨어에서 양자화된 복사 작업의 안정적인 실행을 보장합니다.