Proyek llama.cpp telah menonaktifkan pemuatan tensor malas secara default untuk GPU terintegrasi (iGPU) dalam rilis b10867. Perubahan ini mengatasi regresi yang diperkenalkan dalam pengaturan mode "AUTO" sebelumnya.

  • Pembaruan membatalkan perubahan kecuali menonaktifkan pemuatan malas pada iGPU dalam konfigurasi AUTO.
  • Memperbaiki regresi iGPU dengan menambahkan perbaikan otomatis khusus untuk mode lazy mode.
  • Binari pra-bangun tersedia untuk macOS, Linux, Windows, Android, dan openEuler melalui CPU, CUDA, Vulkan, ROCm, dan backend lainnya.