Проект llama.cpp выпустил версию b11214, содержащую важное обновление для бэкенда HIP. Этот релиз активирует ядро fattn-mma на архитектурах CDNA при dkq > 256, целенаправленно улучшая производительность для больших размеров батча.
- Бэкенд HIP теперь поддерживает ядро fattn-mma для dkq > 256 на оборудовании CDNA.
- Проверки CI для hip-quality-check обновлены: пропуски игнорируются для очень больших ядер mfma mma.
- Бинарные файлы предоставлены для macOS (Apple Silicon и Intel), Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android и openEuler.
Это обновление позволяет пользователям llama.cpp на GPU AMD CDNA использовать оптимизированные ядра внимания для больших размеров батча.