Proyek llama.cpp telah merilis build b10198, yang memperkenalkan dukungan untuk operasi concatenasi kuantisasi di dalam backend Vulkan.

  • Pembaruan teknis utama adalah penambahan dukungan Vulkan untuk concat kuantisasi, yang diimplementasikan dalam pull request #25684.
  • Build macOS Apple Silicon dengan KleidiAI secara eksplisit dinonaktifkan dalam rilis ini.
  • Binari disediakan untuk berbagai platform termasuk macOS (Apple Silicon dan Intel), Linux (Ubuntu x64, arm64, s390x), Windows (CPU, CUDA 12/13, Vulkan, ROCm, OpenVINO, SYCL, HIP), Android, dan openEuler.
  • Binari UI mandiri juga disertakan dalam paket rilis.