Le projet llama.cpp a désactivé le chargement paresseux des tenseurs par défaut pour les GPU intégrés (iGPU) dans la version b10867. Ce changement corrige une régression introduite dans le paramètre de mode "AUTO" précédent.

  • La mise à jour annule les changements, sauf la désactivation du chargement paresseux sur les iGPU au sein de la configuration AUTO.
  • Elle corrige une régression iGPU en ajoutant un correctif automatique spécifique pour le mode lazy mode.
  • Des binaires précompilés sont disponibles pour macOS, Linux, Windows, Android et openEuler via CPU, CUDA, Vulkan, ROCm et d'autres backends.