Le projet llama.cpp a publié la version b11019, corrigeant un bug critique où les fichiers GGUF intégrés à des décalages non alignés renvoyaient des données de tenseur incorrectes. La mise à jour aligne la section de données GGUF par rapport au début du fichier plutôt qu'au décalage 0, garantissant le chargement correct des modèles intégrés.

  • Corrige gguf_init_from_file_ptr pour remplir la section de données à partir du début du GGUF, empêchant les erreurs avec les fichiers intégrés non alignés.
  • Ajoute llama_adapter_lora_init_from_file_ptr pour permettre le chargement d'adaptateurs LoRA via des flux FILE*.
  • Désactive mmap avec un avertissement lorsqu'une section de données intégrée n'est pas alignée, remplaçant les assertions précédentes dans ggml.
  • Inclut des binaires pour macOS (Apple Silicon et Intel), iOS, Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL), Android, Windows et openEuler.

Cette version garantit le fonctionnement fiable des fichiers GGUF intégrés dans d'autres conteneurs ou à des décalages de fichier arbitraires.