llama.cpp 프로젝트는 버전 b11157을 출시하여 CUDA에서 implicit GEMM을 사용한 3D 컨볼루션 연산에 대한 지원을 도입했습니다. 이 업데이트는 빈 커널을 처리하도록 구현을 정제했으며 macOS, Linux, Windows, Android 및 iOS를 포함한 광범위한 플랫폼에서 사용할 수 있습니다.

  • CUDA 백엔드를 위해 implicit GEMM과 함께 conv3d 추가.
  • 빈 커널을 적절히 처리하기 위해 conv3d implicit GEMM 로직 정제.
  • Linux 및 Windows에서 CPU, Vulkan, ROCm, OpenVINO, SYCL, Snapdragon용 바이너리 제공.
  • macOS Apple Silicon (arm64), macOS Intel (x64) 및 iOS XCFramework용 빌드 포함.
  • CPU, Adreno GPU 및 Hexagon NPU 지원을 갖춘 Android arm64 빌드 제공.

이 릴리스는 NVIDIA GPU에서 3D 컨볼루션 연산을 활성화하여 라이브러리의 하드웨어 가속 기능을 확장했습니다.