llama.cpp 프로젝트는 Vulkan 백엔드에서 IQ3_S MMQ 행렬 곱 커널에 대한 지원을 도입한 버전 b11035를 출시했습니다.
- 업데이트에는 Vulkan용 새로운 IQ3_S MMQ matmul 커널이 포함됩니다.
- Block_a_to_shmem은 메모리 접근을 최적화하기 위해 2바이트 로드 작업을 수행합니다.
- IQ3_S가 K 타일 크기를 사용하므로 정렬 확인이 조정되었습니다.
- 바이너리는 CPU, CUDA, ROCm, OpenVINO, SYCL 및 OpenCL 플랫폼에서 macOS, Linux, Windows, Android 및 openEuler에 대해 사용할 수 있습니다.
이 릴리스는 다양한 운영 체제와 하드웨어 가속기를 위한 업데이트된 바이너리를 제공하여 사용자가 새로운 Vulkan 양자화 지원을 활용할 수 있게 합니다.