El proyecto llama.cpp ha lanzado la compilación b10762, que introduce soporte para el modelo DeepSeek-V4-Flash-Vision-Exp. Esta actualización también incluye el manejo de conteos mínimos y máximos de tokens desde la interfaz de línea de comandos.

Los cambios clave en esta versión incluyen:

  • Añadido soporte mtmd para DeepSeek-V4-Flash-Vision-Exp.
  • Implementado manejo de conteos de tokens min/max vía CLI.
  • Cambiado a usar GGML_ROPE_TYPE_VISION.
  • Corregida la lógica del conteo de tokens y eliminado el código de depuración.

El lanzamiento proporciona binarios para macOS, Linux, Windows, Android e iOS a través de varios backends de hardware incluyendo CPU, CUDA, ROCm, Vulkan y OpenVINO.