Proyek llama.cpp merilis build b11272, yang mencakup optimasi untuk backend Hexagon. Perubahan utama berfokus pada optimisasi operasi penggabungan untuk meningkatkan kinerja pada perangkat keras Qualcomm Snapdragon.
- Mengurangi paket dalam loop panas gather/transpose dengan mengumpulkan langsung ke buffer tujuan dan menggunakan instruksi khusus untuk sinkronisasi gather.
- Mengganti panggilan pembagian perangkat lunak dengan fastdiv untuk komputasi yang lebih cepat.
- Mengoptimalkan pipeline DMA-HVX dan menambahkan helper transpose untuk operasi penggabungan Hexagon.
Pembaruan ini menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler di berbagai backend CPU, GPU, dan NPU.