يقدم الباحثون Seed1.5-Thinking، وهو نموذج Mixture-of-Experts يحتوي على 20B من المعلمات النشطة و200B إجماليًا، يستدل قبل الرد. يحقق الأسلوب درجة 86.7 في AIME 2024، و55.0 في Codeforces، و77.3 في GPQA، مما يوضح قدرات استدلال قوية في مجالات STEM والبرمجة.
- يتفوق على DeepSeek R1 بنسبة 8% في معدل الفوز في المهام غير الاستدلالية.
- طوّر معيارين داخليين، BeyondAIME وCodeforces، لتقييم الاستدلال المعمّم.
يُظهر النموذج تعميماً ملحوظاً عبر مجالات متنوعة، مما يشير إلى قابلية تطبيق أوسع تتجاوز مهام الاستدلال البحتة.