Rilis llama.cpp b10676 memperbaiki bug di `conv_transpose_2d` di mana hanya batch pertama yang dihitung, meninggalkan batch berikutnya sebagai nol. Perbaikan ini berlaku untuk pustaka inti ggml dan implementasi backend Metal.

  • ggml: Permutasi sumber dan loop komputasi sekarang mengiterasi dimensi batch, dan ukuran buffer kerja diskalakan oleh jumlah batch.
  • Metal: Grid kernel mencakup semua batch, mendekode indeks batch dari koordinat z untuk menggeser indeks input dan tujuan.
  • Kasus uji multi-batch ditambahkan ke `test-backend-ops` untuk memverifikasi perbaikan.

Ini memastikan bahwa hasil konvolusi multi-batch benar di backend CPU dan GPU.