llama.cpp प्रोजेक्ट ने बिल्ड b11232 जारी किया, जिसमें ggml-cpu बैकएंड के लिए अपडेट शामिल हैं। रिलीज का ध्यान x86 आर्किटेक्चर पर नॉन-वैक्टर-मल्टिपल हेड डायमेंशन के लिए टाइल्ड फ्लैश एटेंशन सक्षम करने पर केंद्रित है।
- x86 पर नॉन-वैक्टर-मल्टिपल हेड डायमेंशन के लिए टाइल्ड फ्लैश एटेंशन सक्षम किया गया।
- simd_gemm_ukernel_tail में मास्क्ड लोडिंग और स्टोरिंग के लिए AVX2 समर्थन जोड़ा गया।
- पैडेड KV टाइल्स के लिए FA softcap हैंडलिंग ठीक की गई।
यह अपडेट CPU, GPU और NPU बैकएंड्स के लिए macOS, Linux, Windows, Android और openEuler के लिए बाइनरी प्रदान करता है।