llama.cpp b11228 릴리스는 Metal 백엔드의 GGML_OP_PAD 연산에서 왼쪽 및 원형 패딩 지원을 도입하여 CPU, CUDA 및 Vulkan 구현과 일치시켰습니다. 이 변경은 순열된 소스의 오른쪽 패딩 문제를 수정하고 다양한 하드웨어 백엔드 간에 일관된 동작을 보장합니다.
- 구현은 왼쪽 패딩만큼 소스 좌표를 이동하고 원형 패딩 모드에서는 이를 감쌉니다.
- 새로운 기능을 커버하기 위한 테스트 케이스가 추가되었습니다.
- f32_4 커널은 느리고 활성화 시 두 가지 패딩 사례에서 실패하므로 제거되었습니다.
- 코드는 원형 패딩 변형을 위해 함수 상수를 사용하여 커널을 한 번 컴파일하고 파이프라인별로 특수화합니다.
이 릴리스는 macOS, iOS, Linux, Windows, Android 및 openEuler에 대한 바이너리를 제공하며, CUDA, Vulkan, ROCm 및 OpenVINO를 포함한 다양한 아키텍처와 백엔드 구성을 지원합니다.