Проект llama.cpp выпустил версию b10930, которая включает исправление для серверного компонента, позволяющее скачивать модели даже тогда, когда пользователь достиг своего лимита.

  • Исправляет проблему #26809, разрешая загрузки при достижении лимита (PR #28530).
  • Предоставляет бинарные файлы для macOS Apple Silicon и Intel, iOS, Ubuntu x64/arm64/s390x, Android arm64, Windows x64/arm64 и openEuler.
  • Поддерживает различные аппаратные бэкенды, включая CPU, Vulkan, ROCm 10.0, OpenVINO, SYCL FP32/FP16, CUDA 12/13 и OpenCL Adreno.

Это обновление обеспечивает продолжение работы для пользователей, достигших квоты хранилища, одновременно предоставляя широкую поддержку платформ.