llama.cpp प्रोजेक्ट ने संस्करण b10336 जारी किया है, जिसमें ggml-webgpu घटक के भीतर कई wgsl फ़ाइलों का रीफैक्टर और flash_attn wgsl का सरलीकरण शामिल है।

यह अपडेट macOS (Apple Silicon और Intel), iOS, Linux (CPU, Vulkan, ROCm 7.2, OpenVINO, SYCL के साथ Ubuntu), Android, Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP) और openEuler प्लेटफ़ॉर्म के लिए बाइनरी प्रदान करता है।

रिलीज़ में मॉडल इनफरेंस इंजन के साथ उपयोगकर्ताओं की बातचीत के लिए मानक UI बिल्ड भी शामिल है।