Проект llama.cpp выпустил версию b10989, которая добавляет поддержку включения операций AllReduce в бэкенде ROCm. Это обновление является частью текущей разработки по расширению аппаратной совместимости и возможностей распределённых вычислений для вывода больших языковых моделей.

  • Релиз включает предварительно собранные бинарные файлы для macOS (Apple Silicon и Intel), Linux (Ubuntu x64, arm64, s390x), Windows и Android.
  • Опции ускорения GPU расширены и включают CUDA 12.8/13.3, Vulkan, OpenVINO, SYCL FP32/FP16 и ROCm 10.0 на поддерживаемых платформах.
  • Предоставлены специфичные сборки для архитектур openEuler x86 и aarch64, включая поддержку ACL Graph для процессоров 910b.
  • Также доступен автономный бинарный файл пользовательского интерфейса alongside релизами основной библиотеки.

Это обновление позволяет пользователям использовать GPU AMD на базе ROCm с функциональностью AllReduce, одновременно предоставляя обновлённые бинарные файлы для различных операционных систем и аппаратных ускорителей.