Le projet ggml-org a publié la version b10774 de llama.cpp, qui inclut une correction pour le problème d'absence de cache KV dans le module de fine-tuning.

  • Le composant d'entraînement gère désormais correctement l'utilisation du cache KV pendant les opérations de fine-tuning.
  • Des binaires sont fournis pour macOS (Apple Silicon et Intel), Linux (Ubuntu avec CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, ROCm) et openEuler.
  • Un XCFramework pour iOS et un package d'interface utilisateur autonome sont également inclus dans les actifs de la version.

Cette mise à jour garantit que les flux de travail de fine-tuning fonctionnent correctement en corrigeant la gestion précédemment défectueuse du cache clé-valeur.