Проект llama.cpp выпустил сборку b10293, которая включает интеграцию непрерывной интеграции AMD ROCm для архитектуры gfx1151 и устраняет проблемы корректности на интегрированных GPU с архитектурой RDNA3.5.

  • Исправляет тест recurrent-state-rollback на gfx1151, разрешая буферы вывода хоста интегрированного GPU в утверждениях отладки.
  • Восстанавливает корректность вывода на RDNA3.5, включая объединенную память для обхода проблем согласованности GPU с весами, загруженными через mmap.
  • Устраняет ошибки асинхронного выполнения в пути HIP, используя HIP_LAUNCH_BLOCKING=1 для сериализации запуска ядер.
  • Пропускает тесты архитектуры jamba и подтесты top-k на бэкенде HIP из-за неподдерживаемых операций и некорректного вывода.

Это обновление обеспечивает надежное тестирование и вывод моделей llama.cpp на оборудовании AMD RDNA3.5 через ROCm.