Meta ने हमेशा-ऑन स्थानीय एजेंट वर्कफ़्लो के लिए अनुकूलित 30-अरब पैरामीटर घन बहुआयामी मॉडल Muse Glimmer जारी किया है। वजन Apache 2.0 लाइसेंस के तहत उपलब्ध हैं।
- ~4-बिट तक क्वांटाइज़ किया गया, मॉडल 20 GB से कम में फ़िट हो जाता है, जिससे 24 GB या 32 GB मेमोरी वाले उपभोक्ता हार्डवेयर पर KV कैश और स्पेक्युलेटिव डिकोडिंग के लिए स्थान बचता है।
- समान आउटपुट गुणवत्ता के साथ महत्वपूर्ण रूप से तेज़ टोकन जनरेशन सक्षम करने वाले स्पेक्युलेटिव डिकोडिंग के लिए एक हल्के DFlash-आधारित ड्राफ्टर के साथ आता है।
- गुणवत्ता और गति को संतुलित करने के लिए नियंत्रणीय तर्क प्रयास के साथ 100+ भाषाओं पर प्रशिक्षित।
- एंड-टू-एंड कार्य पूर्णता, फ़ंक्शन कॉलिंग, मल्टी-स्टेप तर्क और विफलता रिकवरी सहित एजेंटिक कार्यों के लिए अनुकूलित।
इस रिलीज़ का उद्देश्य DeepSearch QA और SWE-Bench जैसे बेंचमार्क्स पर प्रदर्शन बनाए रखते हुए मेमोरी फ़ुटप्रिंट को कम करके जटिल एजेंट लूप के दक्ष स्थानीय निष्पादन को सक्षम बनाना है।