Proyek ggml-org telah merilis versi b10774 dari llama.cpp, yang mencakup perbaikan untuk masalah tidak adanya cache KV di modul fine-tuning.

  • Komponen pelatihan sekarang menangani penggunaan cache KV dengan benar selama operasi fine-tuning.
  • Binari disediakan untuk macOS (Apple Silicon dan Intel), Linux (Ubuntu dengan CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, ROCm), dan openEuler.
  • XCFramework untuk iOS dan paket UI mandiri juga disertakan dalam aset rilis.

Pembaruan ini memastikan bahwa alur kerja fine-tuning berfungsi dengan benar dengan menangani penanganan cache kunci-nilai yang sebelumnya rusak.