La versión llama.cpp b11013 aborda un error de validación en Vulkan corrigiendo la alineación de buffer_reference en los shaders im2col e im2col_3d. La corrección resuelve el problema #28960 alineando el paso del puntero con los tamaños reales de escritura, eliminando las detecciones de GPU-AV.

  • Corrige VUID-RuntimeSpirv-PhysicalStorageBuffer64-06315 provocado por escrituras desalineadas en im2col.comp e im2col_3d.comp.
  • Establece buffer_reference_align = D_SIZE para coincidir con la definición por variante para float (4) y float16_t (2).
  • Reduce las detecciones de validación de 20 a 0 tanto para las operaciones IM2COL como IM2COL_3D.

Este cambio garantiza un comportamiento correcto de validación de Vulkan para la inferencia acelerada por GPU en plataformas compatibles.