Qwen3 तकनीकी रिपोर्ट Qwen मॉडल परिवार के नवीनतम संस्करण को प्रस्तुत करती है, जिसमें 0.6 से 235 अरब तक पैरामीटर स्केल वाले घन और मिक्चर-ऑफ़-एक्सपर्ट (MoE) आर्किटेक्चर शामिल हैं। एक प्रमुख नवाचार जटिल तर्क के लिए विचारन मोड और तेज़ प्रतिक्रियाओं के लिए अविचारन मोड को एकीकृत फ्रेमवर्क में जोड़ना है, जिससे अलग-अलग मॉडल के बीच स्विच करने की आवश्यकता समाप्त हो जाती है।

  • Qwen3 एक विचारन बजत तंत्र का परिचय देता है जो उपयोगकर्ताओं को इनफरेंस के दौरान विलंबता और प्रदर्शन के बीच संतुलन बनाए रखने के लिए कंप्यूटेशनल संसाधनों को अनुकूलित रूप से आवंटित करने की अनुमति देता है।
  • मॉडल श्रृंखला कोड जनरेशन, गणितीय तर्क और एजेंट कार्यों सहित विविध बेंचमार्क्स में सर्वश्रेष्ठ परिणाम प्राप्त करती है।
  • पूर्ववर्ती Qwen2.5 की तुलना में बहुभाषी समर्थन 29 से बढ़कर 119 भाषाओं और बोली तक विस्तारित हो गया है।
  • पुनरुत्पादन और सामुदायिक संचालित शोध को सुगम बनाने के लिए सभी Qwen3 मॉडल Apache 2.0 लाइसेंस के तहत सार्वजनिक रूप से उपलब्ध हैं।

यह एकीकृत दृष्टिकोण उपयोगकर्ता क्वेरी के आधार पर गतिशील मोड स्विचिंग को सक्षम बनाता है, जबकि विस्तारित भाषा समर्थन सुधारित क्रॉस-भाषी समझ के माध्यम से वैश्विक पहुंच को बढ़ावा देता है।