Proyek llama.cpp merilis build b10587, yang memperkenalkan operasi GGML_OP_PAD_REFLECT_1D ke backend Vulkan. Pembaruan ini mengimplementasikan shader komputasi GLSL yang diperlukan dan mendaftarkannya untuk kompilasi SPIR-V di dalam modul ggml-vulkan.

  • Logika PAD_REFLECT_1D diimplementasikan di pad_reflect_1d.comp dan vulkan-shaders-gen.cpp diperbarui untuk pendaftaran.
  • ggml-vulkan.cpp diperbarui untuk menangani konstanta, pembuatan pipeline, fungsi dispatch, dan validasi debug untuk operasi baru.
  • Validasi kebenaran dilakukan pada Intel Iris Xe dengan Vulkan 1.4 dan Mesa 25.2.8, melewati semua kasus uji.
  • Benchmark kinerja disediakan yang menunjukkan waktu eksekusi berkisar dari 5.38 us/run hingga 158.31 us/run di berbagai bentuk tensor.

Rilis ini mengaktifkan penggunaan padding refleksi dalam tugas inferensi yang dipercepat Vulkan dan menyediakan biner untuk platform macOS, Linux, Windows, Android, dan openEuler.