llama.cpp 프로젝트는 WebGPU 백엔드에 대한 중요한 수정과 Windows에서의 하드웨어 지원 확장을 포함하는 빌드 b10721을 출시했습니다.

  • 오프셋이 4의 배수가 아닐 때 WebGPU `ggml_backend_tensor_get()` 구현에서 발생하는 충돌을 수정했습니다.
  • CUDA 13.4가 포함된 Windows arm64에 대한 미리보기 지원을 추가했습니다.
  • macOS (Apple Silicon 및 Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android 및 다양한 CPU 및 GPU 백엔드를 위한 Windows용 바이너리를 제공합니다.

이 릴리스는 정렬되지 않은 메모리 오프셋을 사용하는 WebGPU 사용자의 안정성을 보장하고 Windows에서 새로운 CUDA 아키텍처에 대한 호환성을 확장합니다.