Proyek llama.cpp telah merilis versi b10412, yang memperkenalkan dukungan sampling backend untuk backend dflash dan dspark. Pembaruan ini juga memungkinkan nilai p_min lebih besar dari 0 dalam logika sampling backend dan menambahkan perlindungan yang sesuai.
- Mengaktifkan sampling backend untuk dflash dan dspark.
- Memungkinkan p_min > 0 dalam sampling backend dengan guard tambahan.
- Menyediakan biner untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, OpenVINO, SYCL), Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android, dan openEuler.
Rilis ini memperluas opsi akselerasi perangkat keras yang tersedia bagi pengguna llama.cpp.