llama.cpp 项目发布了构建版本 b10218,其中通过 pull request #25993 添加了 minicpmv46 下采样支持。此更新引入了一个 4x ignore VIT merger,并将下采样模式置于 GGUF 格式内部。

  • 向 mtmd_image_preprocessor_llava_uhd 添加了 minicpmv46 下采样功能。
  • 将下采样模式直接集成到 GGUF 结构中。
  • 在转换过程中包含了 4x ignore VIT merger。

此版本为 macOS、Linux、Windows、Android 和 openEuler 提供了二进制文件,支持包括 CUDA、ROCm、Vulkan 和 OpenVINO 在内的各种硬件加速器。