Proyek llama.cpp merilis build b10655, yang memperkenalkan dukungan untuk operasi LIGHTNING_INDEXER di dalam backend Vulkan untuk mengaktifkan operasi Deepseek V4.

  • Menambahkan operasi LIGHTNING_INDEXer ke backend Vulkan.
  • Memperbarui lightning_indexer.comp dan ggml-vulkan.cpp untuk memindahkan reduksi dot-product 128-lane dari pohon memori bersama ke subgroupAdd.
  • Termasuk perubahan pembersihan seperti melewati pemeriksaan batas dan mengembalikan modifikasi FA_K_ONLY sebelumnya.
  • Memulihkan urutan buffer K/V yang berselang-seling dan menghapus logika FA_K_ONLY.

Pembaruan ini memberikan pengguna Vulkan kemampuan untuk menjalankan operasi Deepseek V4 menggunakan implementasi LIGHTNING_INDEXER baru.