llama.cpp प्रोजेक्ट ने बिल्ड b10796 जारी किया, जिसमें मॉडल लोडर में एक बदलाव शामिल है ताकि परतों के अनुसार विभिन्न संख्या में विशेषज्ञों वाले मॉडलों का समर्थन किया जा सके।
- मॉडल लोडिंग के दौरान विशेषज्ञ परत जांच को संभालने के लिए `n_expert_used_max` फ़ंक्शन जोड़ा गया।
- `llama_model_base::load_hparams` को अपडेट किया गया ताकि असर्शन विफल होने के बजाय `hparams.n_expert_used_max` का उपयोग किया जाए।
- NVIDIA Nemotron-3-Puzzle-75B-A9B जैसे विशिष्ट विशेषज्ञ कॉन्फ़िगरेशन वाले मॉडलों को लोड करते समय त्रुटियों को हल किया गया।
इस अपडेट से llama.cpp उन मॉडलों को सही ढंग से लोड और प्रोसेस कर सकता है जहाँ परतों के अनुसार उपयोग किए जाने वाले विशेषज्ञों की संख्या भिन्न होती है, जिससे प्रारंभिकरण के दौरान असर्शन विफलताएं रोक दी जाती हैं।