llama.cpp प्रोजेक्ट ने बिल्ड b10737 जारी की, जिसने qwen4exp आर्किटेक्चर सपोर्ट में गंभीर बग्स को संबोधित किया। अपडेट सीक्वेंस स्टेट पर्सिस्टेंस से जुड़ी समस्याओं को हल करता है और मॉडल लोड करते समय CUDA अबार्ट्स को रोकता है।

  • qwen4exp मॉडल्स के लिए सेव/रिस्टोर राउंड-ट्रिप्स के दौरान kvu NaN कॉलाप्स ठीक करता है और ext.x/ext.y इंडेक्सर कैश डेटा को पुनर्स्थापित करता है।
  • per_layer_token_embd रो काउंट डेरिवेशन को सही करता है और PLE रिकरेंट कैश लेयर्स में नल पॉइंटर डेरिफरेंसेस को अस्वीकार करता है।
  • qwen4exp के लिए -sm टेंसर फ्लैग को अक्षम करता है, जो पहले असली डिवाइस पर NaN लॉगिट्स और क्रैश का कारण बनता था।
  • फंक्शन ओवरलोडिंग संघर्षों को हल करने के लिए seq_set को seq_get_all में पुनर्नामित करता है और स्टेट अखंडता की पुष्टि करने वाले टेस्ट जोड़ता है।

ये बदलाव सुनिश्चित करते हैं कि qwen4exp मॉडल्स डेटा करप्शन या रनटाइम एरर्स के बिना लोड और सेव किए जा सकें, विशेष रूप से 2D mrope कंटेंट या PLE लेयर्स का उपयोग करते समय।