Proyek llama.cpp telah merilis versi b10705, yang mencakup peningkatan pada mekanisme penanganan TENSOR_READ_LAZY. Pembaruan ini memaksa tensor malas di CPU ketika pengaturan malas diaktifkan.
- Penanganan TENSOR_READ_LAZY yang ditingkatkan di llama.cpp
- Perilaku tensor malas dipaksa di CPU saat mode malas aktif
Rilis ini menyediakan biner yang diperbarui untuk macOS, Linux, Windows, Android, dan iOS di berbagai backend perangkat keras termasuk CPU, CUDA, ROCm, Vulkan, dan OpenVINO.