Proyek llama.cpp merilis versi b11433, yang memperkenalkan dukungan untuk operasi pooling pada NPU Hexagon. Pembaruan ini mencakup implementasi untuk lapisan pooling 2D dan 1D.

  • Menambahkan dukungan pool_2d dan pool_1d untuk backend Hexagon.
  • Mengoptimalkan batas pooling HTP dan pipeline DMA.
  • Menulis ulang pipeline DMA dan menambahkan dukungan chunking pool.
  • Menghapus jalur skalar tervektorisasi dan menyederhanakan solver chunk.

Rilis ini menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler di arsitektur CPU, GPU, dan NPU.