Proyek llama.cpp merilis build b10273, mengatasi masalah kritis di mana sampler berbasis riwayat tidak dapat menyimpulkan panjang konteks yang benar selama inisialisasi karena kendala backend-sampling.
- Memperbaiki -1 menjadi 1024 alih-alih ctx-len untuk sampler guna memperbaiki kesalahan inisialisasi.
- Menetapkan default bersama sebesar 64 untuk sampler berbasis riwayat dan menghapus parameter context_size.
- Menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler melalui CPU, GPU (CUDA, Vulkan, ROCm, SYCL), dan backend OpenVINO.
Pembaruan ini memastikan perilaku sampler yang stabil selama fase konstruksi awal ketika llama_context lengkap belum tersedia.