La version llama.cpp b11013 traite une erreur de validation dans Vulkan en corrigeant l'alignement de buffer_reference dans les shaders im2col et im2col_3d. La correction résout le problème #28960 en alignant le pas du pointeur sur les tailles d'écriture réelles, éliminant ainsi les déclenchements de GPU-AV.

  • Corrige VUID-RuntimeSpirv-PhysicalStorageBuffer64-06315 déclenché par des écritures mal alignées dans im2col.comp et im2col_3d.comp.
  • Définit buffer_reference_align = D_SIZE pour correspondre à la définition par variante pour float (4) et float16_t (2).
  • Réduit les déclenchements de validation de 20 à 0 pour les opérations IM2COL et IM2COL_3D.

Ce changement garantit un comportement correct de validation Vulkan pour l'inférence accélérée par GPU sur les plateformes prises en charge.