Proyek llama.cpp telah merilis versi b10604, memperkenalkan dukungan untuk format model Deepseek 4 (DSV4) bersama dengan biner pra-kompilasi baru untuk macOS dan iOS.
- Menambahkan dukungan tensor sm untuk Deepseek 4 (DSV4) dengan granularitas yang lebih kasar untuk pemisahan kepala dan perbaikan untuk dspark.
- Mengaktifkan penyimpanan model untuk DSV4 dan memungkinkan dflash kembali pada perangkat tertentu.
- Termasuk fungsionalitas allreduce tertunda untuk ahli bersama.
- Menyediakan biner Apple Silicon untuk macOS, XCFrameworks untuk iOS, dan biner yang diperbarui untuk Linux, Windows, Android, dan openEuler melalui CPU, GPU, dan backend khusus.
Rilis ini memungkinkan pengguna menjalankan model Deepseek 4 menggunakan llama.cpp dan menyediakan build asli yang diperbarui untuk perangkat Apple.