Проект llama.cpp выпустил версию b10312, которая включает конкретное обновление компонента сервера. Ключевое изменение устраняет проблему, при которой загруженные модели вытеснялись из маршрутизатора.

  • Сервер: предотвращает вытеснение загруженных моделей (PR #26567).
  • macOS/iOS: предоставляет бинарные файлы для Apple Silicon (arm64) и Intel (x64), а также iOS XCFramework. Поддержка KleidiAI на macOS отключена.
  • Linux: предлагает сборки для процессоров Ubuntu x64, arm64 и s390x, а также варианты Vulkan, ROCm 7.2, OpenVINO, SYCL FP32 и SYCL FP16.
  • Android: включает сборку для процессора arm64.
  • Windows: поддерживает процессоры x64 и arm64, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL и HIP.
  • openEuler: доступны сборки для x86 (310p, 910b ACL Graph) и aarch64 (310p, 910b ACL Graph), тогда как стандартный pull request отключен.

Этот выпуск обеспечивает непрерывную доступность активных моделей в развертываниях сервера и предоставляет комплексные бинарные файлы для основных операционных систем и аппаратных ускорителей.