Проект ggml-org выпустил версию b10774 библиотеки llama.cpp, которая включает исправление проблемы с отсутствием кэша KV в модуле дообучения.
- Компонент обучения теперь корректно обрабатывает использование кэша KV во время операций дообучения.
- Бинарные файлы предоставлены для macOS (Apple Silicon и Intel), Linux (Ubuntu с CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, ROCm) и openEuler.
- В артефакты выпуска также включены iOS XCFramework и автономный пакет пользовательского интерфейса.
Это обновление гарантирует корректную работу рабочих процессов дообучения, устраняя ранее неработающую обработку ключ-значительного кэша.