Le projet llama.cpp a publié la version b10105, qui introduit une refactorisation significative de l'interface en ligne de commande en consolidant les drapeaux de gestion de mémoire séparés en un unique argument `load-mode`.

  • Réorganise les paramètres mmap, mlock et E/S directe en un seul argument pour simplifier la configuration.
  • Corrige des bugs où le comportement des variables était incorrect et mlock ne s'activait pas comme prévu.
  • Met à jour llama-bench pour synchroniser l'analyse des arguments et corriger les problèmes de taille de colonnes.
  • Ajoute des avertissements de dépréciation lors de la combinaison d'anciens et de nouveaux drapeaux pour guider les utilisateurs pendant la transition.
  • Inclut un nettoyage général du code, des mises à jour de documentation via llama-gen-docs et des corrections pour le support des drapeaux dépréciés.

Cette version aide les utilisateurs en rationalisant les options de configuration de la mémoire et en garantissant que des fonctionnalités critiques comme mlock fonctionnent correctement sur les plateformes prises en charge.