शोधकर्ताओं ने Seed1.5-Thinking पेश किया, जो एक Mixture-of-Experts मॉडल है जिसमें 20B सक्रिय और 200B कुल पैरामीटर हैं जो जवाब देने से पहले तर्क करता है। विधि AIME 2024 पर 86.7, Codeforces पर 55.0, और GPQA पर 77.7 हासिल करती है, STEM और कोडिंग में मजबूत तार्किक क्षमताओं को प्रदर्शित करती है।
- गैर-तार्किक कार्यों पर जीत की दर में DeepSeek R1 से 8% अधिक है।
- सामान्यीकृत तर्क का आकलन करने के लिए BeyondAIME और Codeforces दो आंतरिक बेंचमार्क्स विकसित किए गए हैं।
मॉडल विभिन्न क्षेत्रों में उल्लेखनीय सामान्यीकरण प्रदर्शित करता है, जो शुद्ध तार्किक कार्यों के परे व्यापक अनुप्रयोग को संकेत करता है।