llama.cpp परियोजना ने बिल्ड b11382 जारी किया है, जिसमें इसके WebGPU बैकएंड के लिए एक प्रमुख अपडेट शामिल है। इस रिलीज़ में WebGPU कार्यान्वयन के भीतर `fill` और `set_rows` संचालन के लिए विशेष रूप से 16-बिट फ्लोटिंग-पॉइंट (f16) समर्थन जोड़ा गया है।
- स्रोत कोड में परिवर्तन ggml-org/llama.cpp रिपॉजिटरी पर पुल अनुरोध #29897 में ट्रैक किया गया है।
- macOS (Apple Silicon और Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android, और openEuler के लिए बाइनरी प्रदान की गई हैं।
- रिलीज़ में मानक llama.cpp UI बाइनरी भी शामिल है।