Rilis llama.cpp b10676 memperbaiki bug di `conv_transpose_2d` di mana hanya batch pertama yang dihitung, meninggalkan batch berikutnya sebagai nol. Perbaikan ini berlaku untuk pustaka inti ggml dan implementasi backend Metal.
- ggml: Permutasi sumber dan loop komputasi sekarang mengiterasi dimensi batch, dan ukuran buffer kerja diskalakan oleh jumlah batch.
- Metal: Grid kernel mencakup semua batch, mendekode indeks batch dari koordinat z untuk menggeser indeks input dan tujuan.
- Kasus uji multi-batch ditambahkan ke `test-backend-ops` untuk memverifikasi perbaikan.
Ini memastikan bahwa hasil konvolusi multi-batch benar di backend CPU dan GPU.