Proyek llama.cpp telah merilis build b10762, yang memperkenalkan dukungan untuk model DeepSeek-V4-Flash-Vision-Exp. Pembaruan ini juga mencakup penanganan jumlah token minimum dan maksimum dari antarmuka baris perintah.

Perubahan utama dalam rilis ini meliputi:

  • Menambahkan dukungan mtmd untuk DeepSeek-V4-Flash-Vision-Exp.
  • Mengimplementasikan penanganan jumlah token min/max melalui CLI.
  • Beralih ke penggunaan GGML_ROPE_TYPE_VISION.
  • Memperbaiki logika penghitungan token dan menghapus kode debugging.

Rilis ini menyediakan biner untuk macOS, Linux, Windows, Android, dan iOS di berbagai backend perangkat keras termasuk CPU, CUDA, ROCm, Vulkan, dan OpenVINO.