Проект llama.cpp выпустил версию b10989, которая добавляет поддержку включения операций AllReduce в бэкенде ROCm. Это обновление является частью текущей разработки по расширению аппаратной совместимости и возможностей распределённых вычислений для вывода больших языковых моделей.
- Релиз включает предварительно собранные бинарные файлы для macOS (Apple Silicon и Intel), Linux (Ubuntu x64, arm64, s390x), Windows и Android.
- Опции ускорения GPU расширены и включают CUDA 12.8/13.3, Vulkan, OpenVINO, SYCL FP32/FP16 и ROCm 10.0 на поддерживаемых платформах.
- Предоставлены специфичные сборки для архитектур openEuler x86 и aarch64, включая поддержку ACL Graph для процессоров 910b.
- Также доступен автономный бинарный файл пользовательского интерфейса alongside релизами основной библиотеки.
Это обновление позволяет пользователям использовать GPU AMD на базе ROCm с функциональностью AllReduce, одновременно предоставляя обновлённые бинарные файлы для различных операционных систем и аппаратных ускорителей.