llama.cpp 프로젝트는 버전 b11157을 출시하여 CUDA에서 implicit GEMM을 사용한 3D 컨볼루션 연산에 대한 지원을 도입했습니다. 이 업데이트는 빈 커널을 처리하도록 구현을 정제했으며 macOS, Linux, Windows, Android 및 iOS를 포함한 광범위한 플랫폼에서 사용할 수 있습니다.
- CUDA 백엔드를 위해 implicit GEMM과 함께 conv3d 추가.
- 빈 커널을 적절히 처리하기 위해 conv3d implicit GEMM 로직 정제.
- Linux 및 Windows에서 CPU, Vulkan, ROCm, OpenVINO, SYCL, Snapdragon용 바이너리 제공.
- macOS Apple Silicon (arm64), macOS Intel (x64) 및 iOS XCFramework용 빌드 포함.
- CPU, Adreno GPU 및 Hexagon NPU 지원을 갖춘 Android arm64 빌드 제공.
이 릴리스는 NVIDIA GPU에서 3D 컨볼루션 연산을 활성화하여 라이브러리의 하드웨어 가속 기능을 확장했습니다.