El proyecto llama.cpp ha lanzado la compilación b10153, que introduce soporte para la arquitectura del modelo Nanbeige4.2.
- Añade compatibilidad para cargar y ejecutar modelos Nanbeige4.2.
- Corrige las comprobaciones de linting flake8 en la base de código.
- Corrige las comprobaciones de límites de bucle y elimina la lógica redundante de head_dim.
- Proporciona binarios para macOS (Apple Silicon e Intel), Linux, Windows, Android e iOS a través de CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL y otros backends.
Esta actualización permite a los usuarios utilizar el modelo Nanbeige4.2 dentro del marco llama.cpp mientras se benefician de mejoras generales en la calidad del código.