O projeto llama.cpp lançou a compilação b10218, que inclui a adição do suporte ao downsample do minicpmv46 por meio do pull request #25993. Esta atualização introduz um merger VIT 4x ignore e coloca o modo downsample dentro do formato GGUF.

  • Adicionada a funcionalidade de downsample do minicpmv46 ao mtmd_image_preprocessor_llava_uhd.
  • Integrado o modo downsample diretamente na estrutura GGUF.
  • Incluído um merger VIT 4x ignore no processo de conversão.

Esta versão fornece binários para macOS, Linux, Windows, Android e openEuler em vários aceleradores de hardware, incluindo CUDA, ROCm, Vulkan e OpenVINO.