Proyek llama.cpp merilis build b10693, yang memperkenalkan dukungan untuk Qualcomm Hexagon NPUs. Pembaruan ini memungkinkan penemuan inti NPU yang tersedia secara runtime dan memungkinkan pembuatan sesi inferensi sesuai permintaan.
- Ditambahkan antarmuka alokasi dan pembersihan sesi lazy untuk perangkat Hexagon.
- Diimplementasikan penemuan runtime inti NPU yang tersedia.
- Dikonfigurasi penolakan dini perangkat yang tidak ada selama inisialisasi.
- Menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler melalui backend CPU, Vulkan, ROCm, OpenVINO, SYCL, dan CUDA.