Le projet llama.cpp a publié la compilation b10153, qui introduit le support de l'architecture du modèle Nanbeige4.2.

  • Ajoute la compatibilité pour charger et exécuter les modèles Nanbeige4.2.
  • Corrige les vérifications de linting flake8 dans la base de code.
  • Corrige les vérifications des bornes de boucle et supprime la logique redondante de head_dim.
  • Fournit des binaires pour macOS (Apple Silicon et Intel), Linux, Windows, Android et iOS via CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL et autres backends.

Cette mise à jour permet aux utilisateurs d'utiliser le modèle Nanbeige4.2 dans le cadre llama.cpp tout en bénéficiant d'améliorations générales de la qualité du code.