Le projet llama.cpp a publié la version b10930, qui inclut une correction pour le composant serveur permettant de télécharger des modèles même lorsque l'utilisateur a atteint sa limite de modèles.
- Résout le problème #26809 en activant les téléchargements à la limite (PR #28530).
- Fournit des binaires pour macOS Apple Silicon et Intel, iOS, Ubuntu x64/arm64/s390x, Android arm64, Windows x64/arm64 et openEuler.
- Prend en charge divers backends matériels incluant CPU, Vulkan, ROCm 10.0, OpenVINO, SYCL FP32/FP16, CUDA 12/13 et OpenCL Adreno.
Cette mise à jour assure la continuité de fonctionnement pour les utilisateurs atteignant leurs quotas de stockage tout en offrant un large support de plateforme.