Proyek llama.cpp merilis versi b10216, yang memperkenalkan dukungan penuh untuk GGML_OP_POOL_1D pada backend Vulkan. Pembaruan ini mencakup shader komputasi baru yang mencerminkan implementasi pool2d yang ada dan memperbaiki crash yang terjadi ketika dimensi tensor menghasilkan batas akhir negatif.

  • Menambahkan struktur vk_op_pool1d_push_constants dan bidang pipeline_pool1d_f32 untuk operasi pooling 1D.
  • Mengimplementasikan shader pool1d.compute untuk menangani logika pooling 1D di Vulkan.
  • Memperbaiki logika shader dengan mendaftarkan pool1d_f32 dan memperbaiki indeks dimensi tensor serta skala pooling rata-rata.
  • Menyelesaikan masalah crash batas ketika k0 < p0 dan memperluas cakupan pengujian untuk perbaikan tersebut.

Rilis ini memungkinkan pengguna memanfaatkan lapisan pooling 1D dalam model yang dipercepat oleh Vulkan, dengan biner tersedia untuk macOS, Linux, Windows, Android, dan openEuler di CPU, CUDA, ROCm, dan backend lainnya.