Проект llama.cpp выпустил версию b10312, которая включает конкретное обновление компонента сервера. Ключевое изменение устраняет проблему, при которой загруженные модели вытеснялись из маршрутизатора.
- Сервер: предотвращает вытеснение загруженных моделей (PR #26567).
- macOS/iOS: предоставляет бинарные файлы для Apple Silicon (arm64) и Intel (x64), а также iOS XCFramework. Поддержка KleidiAI на macOS отключена.
- Linux: предлагает сборки для процессоров Ubuntu x64, arm64 и s390x, а также варианты Vulkan, ROCm 7.2, OpenVINO, SYCL FP32 и SYCL FP16.
- Android: включает сборку для процессора arm64.
- Windows: поддерживает процессоры x64 и arm64, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL и HIP.
- openEuler: доступны сборки для x86 (310p, 910b ACL Graph) и aarch64 (310p, 910b ACL Graph), тогда как стандартный pull request отключен.
Этот выпуск обеспечивает непрерывную доступность активных моделей в развертываниях сервера и предоставляет комплексные бинарные файлы для основных операционных систем и аппаратных ускорителей.