Rilis llama.cpp b11228 memperkenalkan dukungan untuk padding kiri dan melingkar pada operasi GGML_OP_PAD di backend Metal, menyelaraskannya dengan implementasi CPU, CUDA, dan Vulkan. Perubahan ini memperbaiki masalah padding kanan untuk sumber yang dipermutasi dan memastikan perilaku yang konsisten di berbagai backend perangkat keras.

  • Implementasi menggeser koordinat sumber sebesar padding kiri dan membungkusnya untuk mode padding melingkar.
  • Kasus pengujian telah ditambahkan untuk mencakup fungsionalitas baru.
  • Kernel f32_4 dihapus karena lebih lambat dan gagal pada dua kasus padding saat diaktifkan.
  • Kode menggunakan konstanta fungsi untuk varian padding melingkar agar mengompilasi kernel sekali dan menspesialisasinya per pipeline.

Rilis ini menyediakan biner untuk macOS, iOS, Linux, Windows, Android, dan openEuler di berbagai arsitektur dan konfigurasi backend termasuk CUDA, Vulkan, ROCm, dan OpenVINO.