Le projet llama.cpp a publié la compilation b10587, qui introduit l'opération GGML_OP_PAD_REFLECT_1D dans le backend Vulkan. Cette mise à jour implémente le shader de calcul GLSL nécessaire et l'enregistre pour la compilation SPIR-V au sein du module ggml-vulkan.
- Logique PAD_REFLECT_1D implémentée dans pad_reflect_1d.comp et vulkan-shaders-gen.cpp mis à jour pour l'enregistrement.
- ggml-vulkan.cpp mis à jour pour gérer les constantes, la création de pipelines, les fonctions de dispatch et la validation de débogage pour la nouvelle opération.
- Correction validée sur Intel Iris Xe avec Vulkan 1.4 et Mesa 25.2.8, tous les cas de test sont passés.
- Benchmarks de performance fournis montrant des temps d'exécution allant de 5.38 us/run à 158.31 us/run pour diverses formes de tenseurs.
Cette version permet l'utilisation du padding par réflexion dans les tâches d'inférence accélérées par Vulkan et fournit des binaires pour les plateformes macOS, Linux, Windows, Android et openEuler.