O projeto llama.cpp lançou a compilação b10218, que inclui a adição do suporte ao downsample do minicpmv46 por meio do pull request #25993. Esta atualização introduz um merger VIT 4x ignore e coloca o modo downsample dentro do formato GGUF.
- Adicionada a funcionalidade de downsample do minicpmv46 ao mtmd_image_preprocessor_llava_uhd.
- Integrado o modo downsample diretamente na estrutura GGUF.
- Incluído um merger VIT 4x ignore no processo de conversão.
Esta versão fornece binários para macOS, Linux, Windows, Android e openEuler em vários aceleradores de hardware, incluindo CUDA, ROCm, Vulkan e OpenVINO.