Proyek llama.cpp telah merilis versi b11157, memperkenalkan dukungan untuk operasi konvolusi 3D menggunakan GEMM implisit pada CUDA. Pembaruan ini menyempurnakan implementasi untuk menangani kernel kosong dan tersedia di berbagai platform termasuk macOS, Linux, Windows, Android, dan iOS.
- Menambahkan conv3d dengan GEMM implisit untuk backend CUDA.
- Menyempurnakan logika GEMM implisit conv3d untuk menangani kernel kosong dengan benar.
- Menyediakan biner untuk CPU, Vulkan, ROCm, OpenVINO, SYCL, dan Snapdragon di Linux dan Windows.
- Termasuk build untuk macOS Apple Silicon (arm64), macOS Intel (x64), dan iOS XCFramework.
- Menawarkan build Android arm64 dengan dukungan untuk CPU, GPU Adreno, dan NPU Hexagon.
Rilis ini memperluas kemampuan akselerasi perangkat keras pustaka dengan mengaktifkan operasi konvolusi 3D pada GPU NVIDIA.