Proyek llama.cpp telah merilis build b10727, yang memperkenalkan dukungan penggabungan untuk tipe data terkuantisasi. Pembaruan ini dibantu oleh DeepSeek-V4-Flash-0731 dan mencakup biner untuk macOS, Linux, Windows, Android, dan openEuler di berbagai backend perangkat keras termasuk CPU, CUDA, ROCm, dan Vulkan.

Rilis ini menyediakan biner yang telah dikompilasi sebelumnya untuk beberapa platform dan arsitektur:

  • macOS Apple Silicon (arm64) dan Intel (x64)
  • iOS melalui XCFramework
  • Distribusi Linux termasuk Ubuntu x64, arm64, s390x, dan varian dengan dukungan Vulkan, ROCm 7.14, OpenVINO, dan SYCL
  • Windows x64 dan arm64 dengan opsi CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, dan ROCm 7.14
  • Android arm64 (CPU)
  • Konfigurasi openEuler x86 dan aarch64

Rilis ini memungkinkan pengguna memanfaatkan fungsi penggabungan terkuantisasi baru di berbagai sistem operasi dan akselerator perangkat keras yang didukung.