llama.cpp प्रोजेक्ट ने बिल्ड b11238 जारी किया, जिसमें नई `ggml_pad_ext` फ़ंक्शन के माध्यम से एक समान बाएं पैडिंग कार्यान्वयन पेश किया गया है। यह बदलाव Parakeet, LFM2-Audio, Granite Speech और Gemma 4 जैसे ऑडियो एन्कोडर्स द्वारा उपयोग किए गए पिछले तरीकों को संघित करता है, जिससे Gemma 4 के लिए बिट-समान एम्बेडिंग सुनिश्चित होती है और बैकएंड समर्थन सरल होता है।

  • `ggml_pad_ext` नोड अब सभी बैकएंड्स द्वारा समर्थित होने के कारण एक ही ऑपरेशन में बाएं पैडिंग संभालता है, जटिल रोल या शून्य-फ़िल कंकेनेशन तर्क को प्रतिस्थापित करता है।
  • अपडेट में DFlash2 टैप्स को छोड़ने के लिए एक अनुकूलन शामिल है जो केवल पैडिंग डेटा पढ़ते हैं, क्योंकि ब्लॉक_साइज़ पर या उसके बाद के पद शून्य होते हैं।
  • macOS (Apple Silicon और Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL, Snapdragon), Android, Windows और openEuler के लिए पूर्व-निर्मित बाइनरी उपलब्ध हैं।

यह रिलीज़ पैडिंग ऑपरेशन्स को मानकीकृत करके विभिन्न मॉडल आर्किटेक्चर के बीच स्थिरता में सुधार करती है और हार्डवेयर प्लेटफ़ॉर्म की एक व्यापक श्रृंखला के लिए अद्यतन बाइनरी प्रदान करती है।