Proyek llama.cpp telah merilis build b10153, yang memperkenalkan dukungan untuk arsitektur model Nanbeige4.2.
- Menambahkan kompatibilitas untuk memuat dan menjalankan model Nanbeige4.2.
- Memperbaiki pemeriksaan linting flake8 dalam basis kode.
- Memperbaiki pemeriksaan batas loop dan menghapus logika head_dim yang redundan.
- Menyediakan biner untuk macOS (Apple Silicon dan Intel), Linux, Windows, Android, dan iOS melalui CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL, dan backend lainnya.
Pembaruan ini memungkinkan pengguna memanfaatkan model Nanbeige4.2 dalam kerangka kerja llama.cpp sambil mendapatkan manfaat dari peningkatan kualitas kode secara umum.