Le projet llama.cpp a publié la version b10291, qui inclut des corrections critiques pour le backend Vulkan ainsi que des mises à jour standard de la plateforme. Les principaux changements techniques traitent les problèmes de taille du lot de soumission et introduisent de nouvelles capacités de diagnostic pour les erreurs de pilote.

  • Corrige un bug où le seuil de soumission était appliqué trop tard dans le pipeline Vulkan.
  • Ajoute des outils de débogage pour fournir plus d'informations détaillées lors du diagnostic des erreurs de pilote DeviceLost.
  • Remplace les appels abort par des exceptions throw et implémente des macros de journalisation pour une meilleure gestion des erreurs.
  • Nettoie les dépendances circulaires au sein de la base de code.

Cette version améliore la stabilité pour les utilisateurs exécutant llama.cpp sur du matériel activé Vulkan en résolvant des problèmes spécifiques de temporisation de soumission et en offrant une meilleure visibilité sur les causes des plantages.