La version llama.cpp b11228 introduit le support du remplissage gauche et circulaire dans l'opération GGML_OP_PAD du backend Metal, l'alignant avec les implémentations CPU, CUDA et Vulkan. Cette modification corrige les problèmes de remplissage droit pour les sources permuted et assure un comportement cohérent entre différents backends matériels.
- L'implémentation décale les coordonnées source par les remplitages gauches et les enroule pour les modes de remplissage circulaire.
- Un cas de test a été ajouté pour couvrir la nouvelle fonctionnalité.
- Le kernel f32_4 est supprimé car il est plus lent et échoue sur deux cas de remplissage lorsqu'il est activé.
- Le code utilise une constante de fonction pour la variante de remplissage circulaire afin de compiler le kernel une seule fois et de le spécialiser par pipeline.
La version fournit des binaires pour macOS, iOS, Linux, Windows, Android et openEuler sur diverses architectures et configurations de backend incluant CUDA, Vulkan, ROCm et OpenVINO.