El proyecto llama.cpp ha lanzado la compilación b10150, que incluye ajustes en la lógica de ggml para las operaciones de descarga hacia el backend de los pesos. Esta actualización también aborda correcciones para el grafo llama dsv4.
- ggml: ajustar la lógica para descargar ops al backend de los pesos
- llama: correcciones del grafo dsv4
Esta versión proporciona binarios actualizados para macOS, Linux, Windows, Android e iOS en varios backends de hardware, incluyendo CPU, CUDA, Vulkan, ROCm y OpenVINO.