Proyek llama.cpp telah merilis versi b11214, yang mencakup pembaruan kunci untuk backend HIP. Rilis ini mengaktifkan kernel fattn-mma pada arsitektur CDNA ketika dkq lebih besar dari 256, secara khusus menargetkan peningkatan kinerja untuk ukuran batch besar.
- Backend HIP kini mendukung kernel fattn-mma untuk dkq > 256 pada perangkat keras CDNA.
- Pemeriksaan CI untuk hip-quality-check telah diperbarui untuk mengabaikan spills untuk kernel mfma mma yang sangat besar.
- Binari disediakan untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android, dan openEuler.
Pembaruan ini memungkinkan pengguna yang menjalankan llama.cpp pada GPU AMD CDNA untuk memanfaatkan kernel perhatian yang dioptimalkan untuk ukuran batch yang lebih besar.