llama.cpp 프로젝트는 Vulkan 백엔드에 GGML_OP_PAD_REFLECT_1D 연산을 도입한 빌드 b10587을 출시했습니다. 이 업데이트는 필요한 GLSL 컴퓨트 셰이더를 구현하고 ggml-vulkan 모듈 내에서 SPIR-V 컴파일을 위해 등록합니다.
- pad_reflect_1d.comp에서 PAD_REFLECT_1D 로직을 구현하고 등록을 위해 vulkan-shaders-gen.cpp를 업데이트했습니다.
- 새 연산을 위한 상수 처리, 파이프라인 생성, 디스패치 함수 및 디버그 검증을 처리하도록 ggml-vulkan.cpp를 업데이트했습니다.
- Vulkan 1.4 및 Mesa 25.2.8이 탑재된 Intel Iris Xe에서 정확성을 검증했으며 모든 테스트 케이스를 통과했습니다.
- 다양한 텐서 형태에 대해 5.38 us/run에서 158.31 us/run까지의 실행 시간을 보여주는 성능 벤치마크를 제공했습니다.
이 릴리스는 Vulkan 가속 추론 작업에서 반사 패딩 사용을 가능하게 하며 macOS, Linux, Windows, Android 및 openEuler 플랫폼용 바이너리를 제공합니다.