El proyecto ggml-org ha lanzado la versión b10774 de llama.cpp, que incluye una corrección para el problema de falta de caché KV en el módulo de ajuste fino.
- El componente de entrenamiento ahora maneja correctamente el uso del caché KV durante las operaciones de ajuste fino.
- Se proporcionan binarios para macOS (Apple Silicon e Intel), Linux (Ubuntu con CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, ROCm) y openEuler.
- También se incluyen en los activos del lanzamiento un XCFramework para iOS y un paquete de interfaz de usuario independiente.
Esta actualización asegura que los flujos de trabajo de ajuste fino funcionen correctamente al abordar el manejo previamente roto del caché de clave-valor.