लैब · IBM
lab IBM Research (Granite) · 10 दिन पहले · 16 बार देखा गया

IBM ने Granite 4.2 को native तर्कशक्ति और Granite Speech 5.0 Turbo के साथ जारी किया

IBM ने 3B, 8B, और 30B पैरामीटर आकारों में अपडेटेड Granite 4.2 भाषा मॉडल जारी किए हैं, जो enterprise एजेंटिक वर्कफ्लो के लिए विशेष रूप से बनाए गए हैं और जिनमें native स्टेप-बाय-स्टेप तर्कशक्ति की क्षमताएं शामिल हैं। भाषा मॉडलों के साथ ही, IBM ने Granite Speech 5.0 Turbo CTC पेश किया है, जो edge डिवाइस पर हाई-थ्रूपुट ट्रांसक्रिप्शन के लिए अनुकूलित एक हल्का स्पीच मॉडल है।

lab Hugging Face Blog · 10 दिन पहले · 15 बार देखा गया

IBM ने एजेंटिक क्षमताओं के साथ Granite 4.2 तर्क LLM जारी किए

IBM ने Granite 4.2 जारी किया है, जो 3B, 8B और 30B आकारों में घनत्वपूर्ण, डिकोडर-केवल तर्क बड़े भाषा मॉडलों का एक परिवार है। ये मॉडल लगभग 15 ट्रिलियन टोकन पर शून्य से प्री-ट्रेन किए गए हैं और 512K टोकन तक विस्तारित संदर्भ खिड़की की सुविधा देते हैं।

lab Hugging Face Blog · 2 दिन पहले · 4 बार देखा गया

IBM और Confluent ने रियल-टाइम इनफरेंस के लिए Granite टाइम सीरीज मॉडल्स को एकीकृत किया

IBM और Confluent ने IBM के Granite टाइम सीरीज फाउंडेशन मॉडल्स (TSFM) को Confluent Cloud में एकीकृत किया है, जिससे Apache Flink के भीतर ही रियल-टाइम फोरकास्टिंग और एनोमली डिटेक्शन संभव हुआ है।

media MarkTechPost · 9 दिन पहले SWE-bench Verified · 57.0% · 19 बार देखा गया

IBM ने खुले उद्योग मॉडलों के लिए स्वदेशी तर्क और एजेंटिक RL के साथ Granite 4.2 जारी किया

IBM ने Granite 4.2 जारी किया है, जो 3B, 8B और 30B पैरामीटर आकारों में खुले-स्रोत तर्क भाषा मॉडलों का एक परिवार है, जो साधारण निर्देश अनुसरण के बजाय स्पष्ट चैनल-ऑफ़-थॉट क्षमताओं पर बनाया गया है। ये मॉडल डिकोडर-ओनली घने ट्रान्सफॉर्मर हैं, जिनका लगभग 15 ट्रिलियन टोकन पर पूर्व-प्रशिक्षण किया गया है और बड़े वेरिएंट के लिए एजेंटिक RL सहित बहु-चरण पुनर्बल सीखने की श्रृंखला के माध्यम से पश्च-प्रशिक्षित किया गया है।

media r/LocalLLaMA · 10 दिन पहले · 34 बार देखा गया

IBM ने बिल्ट-इन चेन-ऑफ़-थॉट तर्क के साथ Granite 4.2 परिवार जारी किया

IBM ने ओपन-सोर्स रीजनिंग मॉडल का ग्रैनाइट 4.2 परिवार जारी किया है, जिसमें फ्लैगशिप 30B, मिड-साइज़ 8B और कॉम्पैक्ट 3B वेरिएंट शामिल हैं। ये मॉडल गणित, कोडिंग और जटिल बहु-चरण वाली समस्याओं पर प्रदर्शन में सुधार के लिए नेटिव चेन-ऑफ़-थॉट क्षमताओं का उपयोग करते हैं।

lab Hugging Face Blog · 10 दिन पहले · 23 बार देखा गया

IBM ने Granite Speech 5.0 Turbo CTC मॉडल जारी किए, जिनकी गति 12,600 RTFx से अधिक है

IBM ने Granite Speech परिवार में दो नए कॉम्पैक्ट, 470M-पैरामीटर अंग्रेजी स्पीच रिकग्निशन मॉडल जारी किए हैं: `granite-speech-5.0-470m-turboctc` और `granite-speech-5.0-470m-turboctc-nc`। ये एनकोडर-ओनली मॉडल NVIDIA H200 GPU पर 12,600 RTFx से अधिक अविश्वसनीय ट्रांसक्रिप्शन गति प्राप्त करते हुए उच्च सटीकता बनाए रखते हैं।

github llama.cpp · 15 दिन पहले · 9 बार देखा गया

llama.cpp b10514 में GraniteSWA और GraniteMoeSWA मॉडलों के लिए रूपांतरण समर्थन जोड़ा गया

llama.cpp प्रोजेक्ट ने संस्करण b10514 जारी किया है, जिसमें IBM's GraniteSWAForCausalLM और GraniteMoeSWAForCausalLM आर्किटेक्चर के लिए रूपांतरण इंफ्रास्ट्रक्चर पेश किया गया है। यह अपडेट उपयोगकर्ताओं को इन विशिष्ट मॉडल प्रकारों को llama.cpp के साथ उपयोग के लिए GGUF प्रारूप में बदलने की अनुमति देता है।

lab IBM Research (Granite) · 24 दिन पहले · 25 बार देखा गया

पावर ग्रिड विश्लेषण के लिए IBM रिसर्च ने GENCO एकत्रीकृत न्यूरल सॉल्वर जारी किया

IBM रिसर्च, ब्रूक्हेवन नेशनल लैबोरेटरी और हाइड्रो-क्यूबेक सहित भागीदारों के साथ, स्थिर अवस्था ग्रिड विश्लेषण के लिए एक ओपन-सोर्स ज्यामितीय न्यूरल करेक्टिव सॉल्वर GENCO जारी कर चुका है। यह रिलीज लिनक्स फाउंडेशन एनर्जी (LF Energy) द्वारा होस्ट किए गए OpenGridFM प्रोजेक्ट का हिस्सा है और इसमें न्यूरल ग्रिड सॉल्वर्स को बनाने और बेंचमार्क करने में सुविधा प्रदान करने के लिए GridFM डेवलपमेंट फ्रेमवर्क शामिल है।