llama.cpp 프로젝트가 빌드 b11238를 출시하며, 새로운 `ggml_pad_ext` 함수를 통해 통합된 왼쪽 패딩 구현을 도입했습니다. 이 변경은 Parakeet, LFM2-Audio, Granite Speech, Gemma 4와 같은 오디오 인코더에서 사용되었던 이전 방법들을 통합하여 Gemma 4에 대해 비트 단위 일치 임베딩을 보장하고 백엔드 지원을 단순화합니다.
- 모든 백엔드가 이를 지원하게 됨에 따라 `ggml_pad_ext` 노드는 이제 단일 연산으로 왼쪽 패딩을 처리하며, 복잡한 롤 또는 제로 필드 연결 로직을 대체합니다.
- 이 업데이트에는 블록 크기 이상에서 값이 0이므로 패딩 데이터만 읽는 DFlash2 탭을 건너뛰는 최적화가 포함됩니다.
- macOS(Apple Silicon 및 Intel), iOS, Linux(CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL, Snapdragon), Android, Windows, openEuler에 대해 사전 빌드된 바이너리를 사용할 수 있습니다.
이 릴리스는 패딩 연산을 표준화하여 다양한 모델 아키텍처 간 일관성을 개선하고 광범위한 하드웨어 플랫폼을 위한 업데이트된 바이너리를 제공합니다.