Proyek llama.cpp merilis build b10545, yang mengatasi bug kritis pada kernel perkalian matriks API tensor backend Metal. Pembaruan ini mencegah perilaku tak terdefinisi dan hasil yang rusak saat memproses tensor di mana dimensi K bukan kelipatan 32.

  • Operasi matmul2d sekarang menggunakan dynamic_extent untuk K alih-alih ukuran tile statis.
  • Tampilan tensor operand dibatasi pada rentang K valid yang tersisa pada setiap iterasi.
  • Perubahan ini menghilangkan bacaan di luar batas yang sebelumnya menyebabkan nilai NaN atau kerusakan data.
  • Kasus uji ditambahkan untuk melatih jalur K yang tidak sejajar dan memverifikasi perbaikan.

Perbaikan ini memastikan stabilitas numerik untuk model dengan dimensi matriks tidak sejajar pada perangkat Apple Silicon, mencegah kesalahan diam selama inferensi.