Проект llama.cpp выпустил сборку b10587, которая внедряет операцию GGML_OP_PAD_REFLECT_1D в бэкенд Vulkan. Это обновление реализует необходимый вычислительный шейдер GLSL и регистрирует его для компиляции SPIR-V в модуле ggml-vulkan.

  • Реализована логика PAD_REFLECT_1D в pad_reflect_1d.comp и обновлен vulkan-shaders-gen.cpp для регистрации.
  • Обновлен ggml-vulkan.cpp для обработки констант, создания пайплайна, функций диспетчеризации и отладочной валидации новой операции.
  • Проверена корректность на Intel Iris Xe с Vulkan 1.4 и Mesa 25.2.8, пройдены все тестовые случаи.
  • Предоставлены бенчмарки производительности, показывающие время выполнения от 5.38 us/run до 158.31 us/run для различных форм тензоров.

Это обновление позволяет использовать отражающую-padding в задачах инференса с ускорением Vulkan и предоставляет бинарные файлы для платформ macOS, Linux, Windows, Android и openEuler.