llama.cpp b10666 रिलीज ने टेस्ट-सेव-लोड-स्टेट सूट को सभी आर्किटेक्चर पर चलाने के लिए विस्तारित किया और स्टेट मैनेजमेंट व ग्राफ हैंडलिंग में कई महत्वपूर्ण बग ठीक किए। प्रमुख बदलावों में minimax-01 में डैंगलिंग रेफरेंस को ठीक करना, ऑन-डिवाइस सीक्वेंस के लिए चंक कॉपी को एलाइन करना, और deepseek4 के लिए इंडेक्सर हेड काउंट को सही करना शामिल हैं।

  • टेस्ट-सेव-लोड-स्टेट सूट अब नए --models DIR मोड के जरिए हर *.gguf मॉडल पर चलता है, जिसने पिछले सिंगल-मॉडल सीमा को बदल दिया।
  • ऑन-डिवाइस स्टेट सीक्वेंस कॉप लॉजिक को नॉन-कंटिगियस स्रोतों को हैंडल करने के लिए रिलैक्स किया गया, जहां एक्चर चंक एलाइनमेंट की आवश्यकता के बजाय बाइट कर्सर का उपयोग किया गया।
  • डमी DSA इंडेक्सर पैरामीटर अपडेट किए गए (key_length=128, head_count=64) ताकि फ्यूज्ड लाइटनिंग इंडेक्सर ऑप GPU पर चले और CPU पर फॉलबैक न हो।
  • deepseek4 के इंडेक्सर हेड काउंट को 64 पर सेट किया गया ताकि फिक्स्ड kernel आवश्यकताओं के साथ मेल खा सके और डिवाइस-मिसमैच चेतावनियों से बचा जा सके।
  • minimax-01 के LA ग्राफ इनपुट में डैंगलिंग hparams रेफरेंस को ग्राफ रीयूज के दौरान स्टैक मेमोरी करप्शन रोकने के लिए कॉपी से बदला गया।

ये अपडेट deepseek4, gemma2 और minimax-01 जैसे जटिल आर्किटेक्चर के लिए टेस्ट कवरेज और स्थिरता को बेहतर बनाते हैं, यह सुनिश्चित करते हुए कि स्टेट सिरियलाइजेशन विविध हार्डवेयर बैकएंड पर सही तरीके से काम करे।