El proyecto llama.cpp ha lanzado la compilación b11298, que introduce soporte para el formato dflash. Esta actualización permite tanto la conversión de modelos a este formato como la posterior capacidad de extracción de características.

  • La herramienta de conversión de modelos se ha actualizado para manejar entradas dflash.
  • La funcionalidad de extracción de características ya está disponible para modelos dflash.
  • Se aplicó una corrección al componente 'cont' durante el desarrollo.
  • Se proporcionan binarios para macOS, Linux, Windows, Android y openEuler en backends de CPU, GPU (CUDA, Vulkan, ROCm, OpenCL) y NPU.

Este lanzamiento permite a los usuarios utilizar modelos dflash dentro del ecosistema llama.cpp.