O projeto llama.cpp lançou a compilação b10587, que introduz a operação GGML_OP_PAD_REFLECT_1D no backend Vulkan. Esta atualização implementa o shader de computação GLSL necessário e o registra para compilação SPIR-V dentro do módulo ggml-vulkan.
- Implementada a lógica PAD_REFLECT_1D em pad_reflect_1d.comp e atualizado vulkan-shaders-gen.cpp para registro.
- Atualizado ggml-vulkan.cpp para lidar com constantes, criação de pipelines, funções de despacho e validação de depuração para a nova operação.
- Validada a correção no Intel Iris Xe com Vulkan 1.4 e Mesa 25.2.8, passando em todos os casos de teste.
- Fornecidos benchmarks de desempenho mostrando tempos de execução variando de 5.38 us/run a 158.31 us/run em várias formas de tensores.
Esta versão habilita o uso de padding de reflexão em tarefas de inferência aceleradas por Vulkan e fornece binários para as plataformas macOS, Linux, Windows, Android e openEuler.