llama.cpp 릴리스 b10676은 첫 번째 배치만 계산되고 이후 배치가 0으로 남아 있는 `conv_transpose_2d`의 버그를 수정했습니다. 이 수정은 핵심 ggml 라이브러리와 Metal 백엔드 구현 모두에 적용됩니다.
- ggml: 소스 순열 및 계산 루프가 이제 배치 차원을 반복하며, 작업 버퍼 크기는 배치 수에 따라 스케일링됩니다.
- Metal: 커널 그리드가 모든 배치를 커버하며, z 좌표에서 배치 인덱스를 디코딩하여 입력 및 대상 인덱스를 오프셋합니다.
- 수정을 검증하기 위해 `test-backend-ops`에 여러 배치 테스트 케이스가 추가되었습니다.
이를 통해 CPU 및 GPU 백엔드 간에 여러 배치 컨볼루션 결과가 올바르게 보장됩니다.