El proyecto llama.cpp ha lanzado la compilación b11298, que introduce soporte para el formato dflash. Esta actualización permite tanto la conversión de modelos a este formato como la posterior capacidad de extracción de características.
- La herramienta de conversión de modelos se ha actualizado para manejar entradas dflash.
- La funcionalidad de extracción de características ya está disponible para modelos dflash.
- Se aplicó una corrección al componente 'cont' durante el desarrollo.
- Se proporcionan binarios para macOS, Linux, Windows, Android y openEuler en backends de CPU, GPU (CUDA, Vulkan, ROCm, OpenCL) y NPU.
Este lanzamiento permite a los usuarios utilizar modelos dflash dentro del ecosistema llama.cpp.