Proyek llama.cpp merilis build b11272, yang mencakup optimasi untuk backend Hexagon. Perubahan utama berfokus pada optimisasi operasi penggabungan untuk meningkatkan kinerja pada perangkat keras Qualcomm Snapdragon.

  • Mengurangi paket dalam loop panas gather/transpose dengan mengumpulkan langsung ke buffer tujuan dan menggunakan instruksi khusus untuk sinkronisasi gather.
  • Mengganti panggilan pembagian perangkat lunak dengan fastdiv untuk komputasi yang lebih cepat.
  • Mengoptimalkan pipeline DMA-HVX dan menambahkan helper transpose untuk operasi penggabungan Hexagon.

Pembaruan ini menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler di berbagai backend CPU, GPU, dan NPU.