Proyek llama.cpp merilis versi b10098, yang mencakup pembaruan pada operasi aktivasi Hexagon. Rilis ini menyediakan biner untuk macOS, Linux, Android, Windows, dan openEuler di berbagai backend CPU dan GPU.
- Mengoptimalkan mikrokernel geglu semua-dalam-satu (hex-geglu)
- Mengaktifkan sumber tidak kontinu dan DMA berstrid untuk hex-geglu
- Mengaktifkan sumber tidak kontinu dan DMA berstrid untuk sisa operasi ACT
- Memgeneralisasi fungsi GLU per-thread melalui makro DEFINE_GLU_PER_THREAD
- Memindahkan UNARY_SILU dan UNARY_GELU ke unary-ops
- Mengganti penggunaan scratchpad ops_context generik dengan perhitungan lokal htp_vtcm_layout