Le projet llama.cpp a publié la version b11104, introduisant une nouvelle fonctionnalité permettant au composant llama-server de se lier simultanément à plusieurs adresses réseau.
- Le serveur prend désormais en charge la liaison multi-adresses via la demande de tirage #28690.
- La mise à jour comprend un nettoyage du code, tel que la suppression des gestionnaires de threads redondants et l'amélioration de la gestion des arguments.
- Des binaires précompilés sont disponibles pour macOS (Apple Silicon et Intel), Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android et l'interface utilisateur de llama.cpp.
Cette version offre aux utilisateurs des capacités de serveur mises à jour pour la configuration réseau, accompagnées du support standard des plateformes.