llama.cpp 프로젝트는 Vulkan 백엔드의 중요한 수치 안정성 문제를 해결하고 Windows 사용자를 위한 하드웨어 지원을 확장하는 버전 b10539를 출시했습니다.

  • Vulkan FA MMQ는 qd가 denorm일 때 오버플로우를 방지하기 위해 Q 양자화 계산에 fp32를 사용합니다.
  • CUDA 13용 Windows x64 바이너리와 CUDA 13.4가 포함된 Windows arm64에 대한 미리보기 지원을 추가했습니다.
  • Ubuntu s390x (CPU), macOS Intel (x64), iOS XCFramework에 대한 빌드를 포함했습니다.
  • OpenCL Adreno 지원이 이제 Windows arm64에서 사용 가능합니다.

이 업데이트는 산술 오류를 방지하여 Vulkan 장치에서 안정적인 성능을 보장하고 사용자에게 최신 CUDA 13 호환성 옵션을 제공합니다.