O projeto llama.cpp lançou a compilação b10153, que introduz suporte para a arquitetura do modelo Nanbeige4.2.
- Adiciona compatibilidade para carregar e executar modelos Nanbeige4.2.
- Corrige as verificações de linting flake8 na base de código.
- Corrige verificações de limite de loop e remove a lógica redundante de head_dim.
- Fornece binários para macOS (Apple Silicon e Intel), Linux, Windows, Android e iOS através de CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL e outros backends.
Esta atualização permite que os usuários utilizem o modelo Nanbeige4.2 dentro do framework llama.cpp, beneficiando-se de melhorias gerais na qualidade do código.