Проект llama.cpp выпустил сборку b10587, которая внедряет операцию GGML_OP_PAD_REFLECT_1D в бэкенд Vulkan. Это обновление реализует необходимый вычислительный шейдер GLSL и регистрирует его для компиляции SPIR-V в модуле ggml-vulkan.
- Реализована логика PAD_REFLECT_1D в pad_reflect_1d.comp и обновлен vulkan-shaders-gen.cpp для регистрации.
- Обновлен ggml-vulkan.cpp для обработки констант, создания пайплайна, функций диспетчеризации и отладочной валидации новой операции.
- Проверена корректность на Intel Iris Xe с Vulkan 1.4 и Mesa 25.2.8, пройдены все тестовые случаи.
- Предоставлены бенчмарки производительности, показывающие время выполнения от 5.38 us/run до 158.31 us/run для различных форм тензоров.
Это обновление позволяет использовать отражающую-padding в задачах инференса с ускорением Vulkan и предоставляет бинарные файлы для платформ macOS, Linux, Windows, Android и openEuler.