El proyecto llama.cpp ha lanzado la compilación b10762, que introduce soporte para el modelo DeepSeek-V4-Flash-Vision-Exp. Esta actualización también incluye el manejo de conteos mínimos y máximos de tokens desde la interfaz de línea de comandos.
Los cambios clave en esta versión incluyen:
- Añadido soporte mtmd para DeepSeek-V4-Flash-Vision-Exp.
- Implementado manejo de conteos de tokens min/max vía CLI.
- Cambiado a usar GGML_ROPE_TYPE_VISION.
- Corregida la lógica del conteo de tokens y eliminado el código de depuración.
El lanzamiento proporciona binarios para macOS, Linux, Windows, Android e iOS a través de varios backends de hardware incluyendo CPU, CUDA, ROCm, Vulkan y OpenVINO.