Proyek llama.cpp telah merilis build b10653, memperkenalkan fitur TENSOR_READ_LAZY ke pemuat modelnya. Perubahan ini mencakup penambahan fungsi TENSOR_GET_ROW_LAZY dan flag baris perintah --tensor-read-lazy yang sesuai.
- Menambahkan TENSOR_READ_LAZY dan TENSOR_GET_ROW_LAZY ke pemuat model.
- Memperkenalkan opsi CLI --tensor-read-lazy untuk mengaktifkan pembacaan tensor lambat.
- Menyediakan biner untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android, dan iOS.
Rilis ini memperbarui pustaka inti dengan kemampuan pemuatan lambat baru sambil mendistribusikan biner pra-bangun di seluruh platform yang didukung.