Proyek llama.cpp merilis versi b10870, memperkenalkan dukungan Vulkan untuk pipeline perkalian matriks f16 tipe B dan penyetelan ukuran tile warp secara khusus untuk perangkat keras Intel coopmat1.

  • Menambahkan pipeline perkalian matriks f16 tipe B dan penyetelan ukuran tile warp untuk Intel coopmat1.
  • Mengaktifkan pipeline f16 tipe B untuk perkalian matriks padat di semua vendor, sambil mempertahankan dukungan Mixture of Experts (MoE) hanya untuk Intel.
  • Menambahkan cabang OCP FP4 yang hilang dan membatasi required_subgroup_size ke Intel.
  • Menyederhanakan dan menyempurnakan pemilihan mmp di mul_mat_id.

Pembaruan ini memperluas kompatibilitas Vulkan untuk operasi matriks tertentu dan menyempurnakan logika seleksi internal untuk meningkatkan pemanfaatan perangkat keras.