Проект llama.cpp выпустил сборку b10762, которая добавляет поддержку модели DeepSeek-V4-Flash-Vision-Exp. Это обновление также включает обработку минимального и максимального количества токенов через интерфейс командной строки.

Основные изменения в этом выпуске:

  • Добавлена поддержка mtmd для DeepSeek-V4-Flash-Vision-Exp.
  • Реализована обработка минимального/максимального количества токенов через CLI.
  • Переключено на использование GGML_ROPE_TYPE_VISION.
  • Исправлена логика подсчета токенов и удален отладочный код.

Выпуск предоставляет бинарные файлы для macOS, Linux, Windows, Android и iOS для различных аппаратных бэкендов, включая CPU, CUDA, ROCm, Vulkan и OpenVINO.