llama.cpp प्रोजेक्ट ने संस्करण b10947 जारी किया, जो नेमोट्रॉन-H मॉडल के एक महत्वपूर्ण लोड-टाइम क्रैश को संबोधित करता है। अपडेट शून्य विभाजक त्रुटि से बचाव करता है जो तब होता था जब NextN/MTP टेल लूप ने गैर-MoE परतों के लिए शून्य मान रखने वाली प्रति-परत सरणियों से विशेषज्ञ FFN आकार व्युत्पन्न किया।

  • expert_feed_forward_length अनुपस्थित होने पर शून्य से विभाजित करने के बजाय खराब मेटाडेटा रिपोर्ट करके SIGFPE क्रैश ठीक करता है।
  • macOS (Apple Silicon और Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, OpenCL, Vulkan, OpenVINO, SYCL, ROCm) और openEuler के लिए बाइनरी प्रदान करता है।

यह बदलाव चेकपॉइंट लोडिंग के दौरान सिग्नल त्रुटि के साथ एप्लिकेशन के मरने से रोकता है, मिश्रित MoE और घनी परतों वाले मॉडलों के लिए स्थिर संचालन सुनिश्चित करता है।