Proyek llama.cpp merilis build b11158, yang mencakup penyesuaian dukungan matriks kooperatif KHR secara khusus untuk GPU Adreno melalui backend Vulkan.

  • Mengaktifkan dukungan matriks kooperatif (coopmat) untuk backend Vulkan guna meningkatkan kinerja pada perangkat keras yang kompatibel.
  • Memperbaiki fungsi mul_mat_s di dalam implementasi.
  • Menghapus pernyataan debug dari basis kode.

Pembaruan ini menyediakan akselerasi GPU yang dioptimalkan untuk perangkat Snapdragon yang menjalankan Linux dan Android, serta sistem Windows arm64 dengan grafis Adreno.