Proyek llama.cpp merilis versi b11433, yang memperkenalkan dukungan untuk operasi pooling pada NPU Hexagon. Pembaruan ini mencakup implementasi untuk lapisan pooling 2D dan 1D.
- Menambahkan dukungan pool_2d dan pool_1d untuk backend Hexagon.
- Mengoptimalkan batas pooling HTP dan pipeline DMA.
- Menulis ulang pipeline DMA dan menambahkan dukungan chunking pool.
- Menghapus jalur skalar tervektorisasi dan menyederhanakan solver chunk.
Rilis ini menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler di arsitektur CPU, GPU, dan NPU.