Proyek llama.cpp merilis versi b11309, yang mencakup optimasi kunci untuk backend Hexagon. Pembaruan ini menambahkan dukungan untuk mode scatter aman ke operasi ALLREDUCE, bertujuan untuk meningkatkan kinerja dan stabilitas pada perangkat Qualcomm Snapdragon.
- Mengoptimalkan ALLREDUCE Hexagon dengan menambahkan dukungan mode scatter aman.
- Menulis ulang implementasi hex-allreduce untuk menghilangkan tumpahan register.
- Mengurangi komentar berlebihan dalam kode hex-allreduce.
- Menyediakan biner untuk macOS (Apple Silicon dan Intel), Linux, Windows, Android, dan openEuler melalui backend CPU, GPU, dan NPU.
Rilis ini memungkinkan inferensi terdistribusi yang lebih efisien pada perangkat mobile dengan NPU Hexagon sambil mempertahankan kompatibilitas luas di seluruh sistem operasi desktop dan mobile utama.