Le projet llama.cpp a publié la compilation b10153, qui introduit le support de l'architecture du modèle Nanbeige4.2.
- Ajoute la compatibilité pour charger et exécuter les modèles Nanbeige4.2.
- Corrige les vérifications de linting flake8 dans la base de code.
- Corrige les vérifications des bornes de boucle et supprime la logique redondante de head_dim.
- Fournit des binaires pour macOS (Apple Silicon et Intel), Linux, Windows, Android et iOS via CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL et autres backends.
Cette mise à jour permet aux utilisateurs d'utiliser le modèle Nanbeige4.2 dans le cadre llama.cpp tout en bénéficiant d'améliorations générales de la qualité du code.