Проект llama.cpp выпустил версию b11090, которая включает исправление ошибки компиляции тайлов sm_70. Обновление обобщает форму тайла функции load_ldmatrix с 5 аргументами для устранения несоответствий с архитектурами Volta.

  • Исправляет ошибки компиляции на sm_70 путем обобщения форм тайлов load_ldmatrix от <16,8> к <I,J>.
  • Предоставляет бинарные файлы для macOS (Apple Silicon и Intel), iOS, Linux (CPU, CUDA, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA, Vulkan, OpenCL, OpenVINO, SYCL, ROCm), Android и openEuler.

Этот выпуск обеспечивает совместимость со старыми архитектурами GPU при сохранении поддержки широкого спектра операционных систем и аппаратных ускорителей.