llama.cpp 프로젝트가 버전 b11214를 출시했으며, 여기에는 HIP 백엔드에 대한 주요 업데이트가 포함되어 있습니다. 이 릴리스는 dkq > 256일 때 CDNA 아키텍처에서 fattn-mma 커널을 활성화하여 큰 배치 크기에 대한 성능 향상을 목표로 합니다.
- HIP 백엔드가 이제 CDNA 하드웨어에서 dkq > 256에 대한 fattn-mma 커널을 지원합니다.
- hip-quality-check에 대한 CI 체크가 매우 큰 mfma mma 커널의 스플릴(spills)을 무시하도록 업데이트되었습니다.
- macOS (Apple Silicon 및 Intel), Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android 및 openEuler에 대한 바이너리가 제공됩니다.
이 업데이트를 통해 AMD CDNA GPU에서 llama.cpp를 실행하는 사용자는 더 큰 배치 크기를 위한 최적화된 어텐션 커널을 활용할 수 있습니다.