Le projet llama.cpp a publié la compilation b11301, qui inclut une correction pour un problème de débordement entier au sein des composants ggml et gguf. Cette mise à jour traite la logique de validation pour prévenir d'éventuelles erreurs lors de la manipulation de tenseurs à zéro élément.

  • Corrige la protection contre le débordement entier pour les tenseurs à zéro élément dans ggml.
  • Valide le nombre d'éléments dans les tenseurs pour prévenir les débordements entiers.
  • Corrige l'impression des erreurs dans le module ggml.

La version fournit des binaires pour macOS, Linux, Windows, Android et openEuler via les backends CPU, GPU (CUDA, Vulkan, ROCm, OpenCL) et NPU.