Proyek llama.cpp merilis build b10691, yang mengatasi masalah stabilitas kritis di backend Metal. Pembaruan ini secara khusus menyelesaikan crash null-pipeline yang terjadi selama operasi perkalian sumber F16.

  • Memperbaiki crash null-pipeline untuk operasi mul_mat dan mul_mat_id dengan src1 F16.
  • Mengimplementasikan perilaku fail-closed untuk bentuk mul_mat yang tidak memiliki kernel F16.
  • Menambahkan logika abort untuk pipeline nil di encoder_set_pipeline.
  • Berbagi dispatch mul_mat mm dengan supports_op untuk meningkatkan konsistensi kode.

Rilis ini menyediakan biner untuk macOS, iOS, Linux, Windows, Android, dan openEuler melalui CPU, GPU, dan backend perangkat keras khusus termasuk CUDA, ROCm, Vulkan, dan OpenVINO.