llama.cpp 프로젝트는 버전 b11147을 출시했으며, 이는 OpenCL용 새로운 이진 커널을 도입합니다. 이 업데이트는 특히 A8 Q6_K non-MoE dp4a 구성에 대한 지원을 추가합니다.
- OpenCL용 A8 Q6_K non-MoE dp4a 이진 커널 추가.
- macOS (Apple Silicon 및 Intel), iOS, Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Android, Windows (CPU, Adreno, CUDA, Vulkan, OpenVINO, SYCL, ROCm) 및 openEuler용 바이너리 제공.
이 릴리스를 통해 사용자는 최신 커널 최적화와 함께 광범위한 하드웨어 플랫폼에서 llama.cpp를 실행할 수 있습니다.