Proyek llama.cpp merilis versi b10594, yang mencakup perbaikan untuk melewati loop device_info ketika tingkat log tidak diatur ke LOG_LEVEL_TRACE. Sebelumnya, loop ini mengiterasi perangkat yang ditemukan untuk menghitung memori, yang memerlukan pembuatan konteks GPU dan mengakibatkan alokasi VRAM sebesar 550 MB bahkan ketika data dibuang.
- Perubahan ini mencegah penggunaan sumber daya GPU yang tidak perlu dengan memeriksa tingkat verbositas sebelum melakukan iterasi.
- Binari tersedia untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android, dan iOS.
- Rilis ini juga menyediakan binari UI dan atestasi untuk verifikasi.
Pembaruan ini membantu pengguna yang tidak ingin menggunakan sumber daya GPU untuk menghindari overhead pembuatan konteks dan alokasi VRAM ketika informasi perangkat tidak diperlukan.