Proyek llama.cpp telah merilis build b10653, memperkenalkan fitur TENSOR_READ_LAZY ke pemuat modelnya. Perubahan ini mencakup penambahan fungsi TENSOR_GET_ROW_LAZY dan flag baris perintah --tensor-read-lazy yang sesuai.

  • Menambahkan TENSOR_READ_LAZY dan TENSOR_GET_ROW_LAZY ke pemuat model.
  • Memperkenalkan opsi CLI --tensor-read-lazy untuk mengaktifkan pembacaan tensor lambat.
  • Menyediakan biner untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android, dan iOS.

Rilis ini memperbarui pustaka inti dengan kemampuan pemuatan lambat baru sambil mendistribusikan biner pra-bangun di seluruh platform yang didukung.