IBM ने Granite 4.2 जारी किया है, जो 3B, 8B और 30B आकारों में घनत्वपूर्ण, डिकोडर-केवल तर्क बड़े भाषा मॉडलों का एक परिवार है। ये मॉडल लगभग 15 ट्रिलियन टोकन पर शून्य से प्री-ट्रेन किए गए हैं और 512K टोकन तक विस्तारित संदर्भ खिड़की की सुविधा देते हैं।

  • प्रशिक्षण पाइपलाइन में चेन-ऑफ़-थॉट और एजेंटिक-ट्रैजेक्टरी डेटा पर सूपरवाइज्ड फाइन-ट्यूनिंग शामिल है, जिसके बाद मल्टी-स्टेज रीइंफोर्समेंट लर्निंग आती है।
  • 8B और 30B मॉडल्स वास्तविक सैंडबॉक्स्ड वातावरणों में टूल उपयोग सीखने के लिए एजेंटिक RL से गुजरते हैं, जिसमें सॉफ्टवेयर इंजीनियरिंग और वेब सर्च शामिल हैं।
  • सभी मॉडल्स ओपनएआई-कम्पैटिबल एंडपॉइंट के माध्यम से नेटिव टूल कॉलिंग का समर्थन करते हैं और थिंकिंग या नॉन-थिंकिंग मोड के लिए एक स्विच शामिल है।
  • मॉडल्स को Apache 2.0 लाइसेंस के तहत जारी किया गया है।