Проект ggml-org выпустил версию b10774 библиотеки llama.cpp, которая включает исправление проблемы с отсутствием кэша KV в модуле дообучения.

  • Компонент обучения теперь корректно обрабатывает использование кэша KV во время операций дообучения.
  • Бинарные файлы предоставлены для macOS (Apple Silicon и Intel), Linux (Ubuntu с CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, ROCm) и openEuler.
  • В артефакты выпуска также включены iOS XCFramework и автономный пакет пользовательского интерфейса.

Это обновление гарантирует корректную работу рабочих процессов дообучения, устраняя ранее неработающую обработку ключ-значительного кэша.