llama.cpp b10361 रिलीज़ ने एक गंभीर बग को संबोधित किया जहाँ लोडिंग के दौरान गलत पैरामीटर ऑर्डरिंग के कारण LGAI-EXAONE 4.5 मॉडल के लिए स्लाइविंग विंडो एटेंशन (SWA) सक्षम नहीं था।

  • मॉडल लोडर अब `hparams.n_layer()` और `LLM_KV_NEXTN_PREDICT_LAYERS` को पढ़े जाने के क्रम को ठीक करके EXAONE 4.5 GGUF फ़ाइलों को सही ढंग से संभालता है, यह सुनिश्चित करते हुए कि SWA उचित रूप से सक्रिय हो।
  • मॉडल बनाने के लिए केवल मेटाडेटा पथ अब `TENSOR_SKIP` के साथ चिह्नित टेंसर को छोड़ देता है, जिससे अगलेn/MTP परतों का उपयोग करने वाली आर्किटेक्चर में नल बफ़र प्रकारों से होने वाले एसर्शन फेल्योर को रोका जाता है।
  • EXAONE 4 hparams ऑर्डरिंग को कवर करने के लिए टेस्ट जोड़े गए हैं, यह सत्यापित करते हुए कि ठीक `swa_type` को NONE के बजाय STANDARD पर सेट करता है।

इस अपडेट ने सुनिश्चित किया है कि आधिकारिक LGAI-EXAONE GGUF रिलीज़ स्लाइविंग विंडो एटेंशन के साथ सही ढंग से काम करती हैं और अगलेn/MTP परतों वाले मॉडल को केवल मेटाडेटा पथ के माध्यम से बनाया जा सकता है।