El proyecto llama.cpp lanzó la compilación b10587, que introduce la operación GGML_OP_PAD_REFLECT_1D en el backend de Vulkan. Esta actualización implementa el shader de cómputo GLSL necesario y lo registra para la compilación SPIR-V dentro del módulo ggml-vulkan.

  • Implementada la lógica PAD_REFLECT_1D en pad_reflect_1d.comp y actualizado vulkan-shaders-gen.cpp para el registro.
  • Actualizado ggml-vulkan.cpp para manejar constantes, creación de pipelines, funciones de envío y validación de depuración para la nueva operación.
  • Validada la corrección en Intel Iris Xe con Vulkan 1.4 y Mesa 25.2.8, pasando todos los casos de prueba.
  • Proporcionados benchmarks de rendimiento que muestran tiempos de ejecución desde 5.38 us/run hasta 158.31 us/run en varias formas de tensores.

Esta versión habilita el uso de relleno por reflexión en tareas de inferencia aceleradas por Vulkan y proporciona binarios para las plataformas macOS, Linux, Windows, Android y openEuler.