llama.cpp プロジェクトはバージョン b11157 をリリースし、CUDA 上で implicit GEMM を使用した 3D 畳み込み演算のサポートを導入しました。このアップデートは空のカーネルを処理できるように実装を refinements し、macOS、Linux、Windows、Android、iOS など幅広いプラットフォームで利用可能です。

  • CUDA バックエンド用に implicit GEMM を備えた conv3d を追加。
  • 空のカーネルを適切に処理するために conv3d implicit GEMM のロジックを refinements。
  • Linux および Windows 向けに CPU、Vulkan、ROCm、OpenVINO、SYCL、Snapdragon のバイナリを提供。
  • macOS Apple Silicon (arm64)、macOS Intel (x64)、iOS XCFramework のビルドを含みます。
  • CPU、Adreno GPU、Hexagon NPU のサポート付き Android arm64 ビルドを提供。

このリリースにより、NVIDIA GPU 上で 3D 畳み込み演算を有効にすることで、ライブラリのハードウェアアクセラレーション機能が拡張されました。