Proyek llama.cpp merilis build b11338, memperkenalkan mekanisme salinan Direct Memory Access (DMA) strided bersama untuk operasi CPY dan CONCAT. Pembaruan ini memungkinkan CONCAT dimensi apa pun melalui DMA pada arsitektur Hexagon.
- Mengimplementasikan salinan DMA strided bersama untuk operasi CPY dan CONCAT.
- Mengaktifkan CONCAT dimensi apa pun melalui DMA.
- Menghapus logika CONCAT_DMA_MIN_ROW yang rusak yang tidak kompatibel dengan DMA 64-bit.
- Menambahkan panggilan dma_queue_flush() yang hilang dan pengaman tambahan untuk kondisi yang tidak didukung.
Rilis ini menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler di seluruh backend CPU, GPU, dan NPU.