Le projet llama.cpp a publié la compilation b10273, corrigeant un problème critique où les sampleurs basés sur l'historique ne pouvaient pas inférer la longueur correcte du contexte lors de l'initialisation en raison des contraintes du backend d'échantillonnage.
- Corrige -1 à 1024 au lieu de ctx-len pour les sampleurs afin de résoudre les erreurs d'initialisation.
- Définit une valeur par défaut partagée de 64 pour les sampleurs basés sur l'historique et supprime le paramètre context_size.
- Fournit des binaires pour macOS, Linux, Windows, Android et openEuler via CPU, GPU (CUDA, Vulkan, ROCm, SYCL) et backends OpenVINO.
Cette mise à jour assure un comportement stable du sampleur pendant les phases précises de construction lorsque le llama_context complet n'est pas encore disponible.