Proyek llama.cpp merilis versi b10675, yang mencakup pembaruan kunci pada backend Vulkan-nya. Rilis ini menambahkan dukungan hoisting untuk ID baris dan jumlah ahli di dalam kode shader.
- Implementasi menggunakan ID baris yang di-hoist di coopmat2.
- Ini menanggapi umpan balik tinjauan mengenai count_experts dengan menggunakan vk_op_count_experts_push_constants alih-alih vektor uint mentah.
- Trik fastdiv diterapkan pada operasi div/mod ne00 dalam count_experts.
- Offset per ahli dihitung dengan subgroupExclusiveAdd di mana didukung, mempertahankan jalur serial sebagai fallback.
Pembaruan ini menyediakan build Vulkan yang dioptimalkan untuk macOS, Linux, Windows, dan Android di berbagai backend perangkat keras termasuk CUDA, ROCm, dan OpenCL.