llama.cpp प्रोजेक्ट ने बिल्ड b11333 जारी किया है, जिसने अपने WebGPU बैकएंड में MUL_MAT, MUL_MAT_ID और GET_ROWS ऑपरेशन्स के लिए bfloat16 समर्थन पेश किया है।
यह अपडेट macOS (Apple Silicon और Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Windows, Android और openEuler के लिए प्रीकंपाइल बाइनरीज़ में शामिल है। रिलीज में CUDA 12 और 13, Vulkan, ROCm 10.0, OpenVINO, SYCL और Snapdragon NPUs सहित विभिन्न हार्डवेयर एक्सेलेरेटर के लिए बिल्ड प्रदान किए गए हैं।
इन विशिष्ट WebGPU मैट्रिक्स ऑपरेशन्स में bfloat16 सटीकता जोड़ने से संगत GPU पर अधिक कुशल गणना की अनुमति मिलती है।