Proyek llama.cpp telah merilis versi b10312, yang mencakup pembaruan spesifik pada komponen server. Perubahan utama mengatasi masalah di mana model sibuk dikeluarkan dari router.

  • Server: Mencegah pengeluaran model sibuk (PR #26567).
  • macOS/iOS: Menyediakan biner untuk Apple Silicon (arm64) dan Intel (x64), serta iOS XCFramework. Dukungan KleidiAI pada macOS dinonaktifkan.
  • Linux: Menawarkan build untuk Ubuntu x64, arm64, dan CPU s390x, serta varian Vulkan, ROCm 7.2, OpenVINO, SYCL FP32, dan SYCL FP16.
  • Android: Termasuk build CPU arm64.
  • Windows: Mendukung CPU x64 dan arm64, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, dan HIP.
  • openEuler: Build untuk x86 (310p, 910b ACL Graph) dan aarch64 (310p, 910b ACL Graph) tersedia, sementara pull request standar dinonaktifkan.

Rilis ini memastikan ketersediaan berkelanjutan model aktif dalam penempatan server dan menyediakan biner komprehensif di berbagai sistem operasi utama serta akselerator perangkat keras.