Proyek llama.cpp telah merilis build b10150, yang mencakup penyesuaian pada logika ggml untuk operasi pengalihan ke backend berat. Pembaruan ini juga menangani perbaikan untuk grafik llama dsv4.

  • ggml: sesuaikan logika pengalihan ops ke backend berat
  • llama: perbaikan grafik dsv4

Rilis ini menyediakan biner yang diperbarui untuk macOS, Linux, Windows, Android, dan iOS di berbagai backend perangkat keras termasuk CPU, CUDA, Vulkan, ROCm, dan OpenVINO.