Proyek llama.cpp merilis build b10883, yang mencakup pembaruan signifikan pada backend Vulkan. Perubahan utama melibatkan penggunaan konstanta spesifikasi untuk operasi perkalian matriks-matriks tipe A guna meningkatkan kompilasi shader dan kinerja.

  • Gunakan konstanta spesifikasi untuk mul mat type_a di shader Vulkan.
  • Konsolidasi tabel memori bersama dan kurangi ukuran dengan konstanta spesifikasi tipe.
  • Pulihkan optimasi coopmat2 q4_k/q5_k dan pisahkan shader untuk memperbaiki regresi Ampere.
  • Perbaiki tipe Q2_0 yang hilang di cm2 matmul dan sesuaikan perubahan penyetelan f16 Intel.
  • Kerjaan bug kompilator cm2 dengan menggunakan ukuran memori bersama minimal 8.

Rilis ini menyediakan biner yang diperbarui untuk macOS, Linux, Windows, Android, dan openEuler di backend CPU, GPU, dan perangkat keras khusus.