أصدرت ديب سيك تحديثاً مهماً لنموذج DeepSeek-R1-0528، مما يعزز قدراته على الاستدلال ويقلص فجوة الأداء مع النماذج المملوكة الرائدة من OpenAI وGoogle. يعتمد التحديث على خوارزميات محسّنة وقوة حوسبة أكبر لرفع الدقة في اختبارات الرياضيات والبرمجة والمنطق دون تغيير الهندسة الأساسية.

  • على AIME 2025، ارتفعت الدقة من 70% إلى 87.5%, بينما زاد متوسط رموز الطلب من 12,000 إلى 23,000.
  • شهدت اختبارات الرياضيات تحسناً في AIME 2024 (من 79.8% إلى 91.4%)، وHMMT 2025 (من 41.7% إلى 79.4%)، وCNMO 2024 (من 78.8% إلى 86.9%).
  • تحسّن أداء البرمجة على LiveCodeBench (من 63.5% إلى 73.3%) وAider-Polyglot (من 53.3% إلى 71.6%)، مع ارتفاع تصنيف Codeforces من 1530 إلى 1930.
  • ارتفعت درجات المعرفة العامة على GPQA-Diamond (من 71.5% إلى 81.0%) وامتحان Humanity's Last Exam (من 8.5% إلى 17.7%).
  • صنّفت منصة Artificial Analysis المستقلة النموذج بدرجة 68، مما يضعه أمام Llama 4 Maverick من Meta وQwen3 253 من Alibaba.

يُظهر التحديث أن النماذج ذات الأوزان المفتوحة يمكنها تحقيق أداء تنافسي من خلال زيادة التدريب اللاحق باستخدام التعلم بالتعزيز. أصدرت ديب سيك أيضاً نسخة مُقطّرة، وهي DeepSeek-R1-0528-Qwen3-8B، والتي تحقق 86% على AIME 2024 بينما تعمل بكفاءة على Nvidia H100.