llama.cpp प्रोजेक्ट ने संस्करण b11157 जारी किया है, जिसमें CUDA पर implicit GEMM का उपयोग करके 3D convolution ऑपरेशन के लिए समर्थन पेश किया गया है। यह अपडेट खाली kernels को हैंडल करने के लिए कार्यान्वयन को परिष्कृत करता है और macOS, Linux, Windows, Android, और iOS सहित विभिन्न प्लेटफार्मों पर उपलब्ध है।
- CUDA backends के लिए implicit GEMM के साथ conv3d जोड़ा।
- खाली kernels को उचित रूप से हैंडल करने के लिए conv3d implicit GEMM तर्क को परिष्कृत किया।
- Linux और Windows पर CPU, Vulkan, ROCm, OpenVINO, SYCL, और Snapdragon के लिए binaries प्रदान किए।
- macOS Apple Silicon (arm64), macOS Intel (x64), और iOS XCFramework के लिए builds शामिल हैं।
- CPU, Adreno GPU, और Hexagon NPU के साथ Android arm64 builds की पेशकश की।
इस रिलीज ने NVIDIA GPUs पर 3D convolution ऑपरेशन सक्षम करके लाइब्रेरी के हार्डवेयर एक्सेलरेशन क्षमताओं को बढ़ाया है।