llama.cpp 프로젝트는 유형 블록 크기에 따라 텐서 바인딩을 정렬하여 WebGPU를 수정한 빌드 b10921을 출시했습니다. 이 변경으로 인해 블록 양자화된 뷰가 셰이더에서 유효한 요소 오프셋을 받으며, 텐서까지의 거리가 블록의 정수 배수가 될 때까지 바인딩 오프셋을 역방향으로 탐색합니다.
이번 릴리스는 macOS(Apple Silicon 및 Intel), iOS, Linux(CPU, Vulkan, ROCm, OpenVINO, SYCL 백엔드 지원 Ubuntu), Android, Windows(CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), openEuler용 바이너리 및 프레임워크를 제공합니다.
이 업데이트는 WebGPU 셰이더에서 텐서 처리가 올바르게 수행되도록 하면서 광범위한 하드웨어 아키텍처 및 백엔드 구현에 대한 지원을 유지합니다.