llama.cpp प्रोजेक्ट ने बिल्ड b10760 जारी किया, जिसमें संख्यात्मक अस्थिरता को रोकने के लिए Qwen3-tts-0.6B मॉडल के लिए विशिष्ट ठीक शामिल हैं।

  • mtmd लोडर अब qwen3-tts कोड प्रेडिक्टर proj_in को वैकल्पिक मानता है, जिससे इस टेंसर को छोड़ने वाले संदर्भ कार्यान्वयन के साथ समानता होती है।
  • कोड प्रेडिक्टर ffn_down परत को F32 सटीकता में रखा गया है क्योंकि इसके सक्रियण 1.5e5 के आसपास शीर्ष पर पहुंचते हैं, जो F16 की सीमा से अधिक है और NaN त्रुटियां पैदा करते हैं।

ये बदलाव सुनिश्चित करते हैं कि ग्राफ़ अनुपस्थित वजन को सही ढंग से संभालता है और इस विशिष्ट चेकपॉइंट में उच्च-सक्रियण परतों में ओवरफ्लो को रोकता है।