أطلقت ديب سيك رسميًا نموذج DeepSeek V4.1 Flash، وهو أصغر عضو في سلسلة معماريتها الجديدة التي تتميز بالفهم البصري متعدد الوسائط الأصلي. مبني على تصميم Causal-Encoder-Decoder، فهو نموذج Mixture of Experts (MoE) بـ 552B معامل، ينشط فقط 8B معامل من جانب الإدخال و16B من جانب الإخراج.

  • تقلل المعمارية غير المتماثلة تكاليف الاستدلال بشكل كبير مقارنة بالنماذج المعروفة بنفس الحجم.
  • يقلل ضغط ذاكرة التخزين المؤقت KV متطلبات HBM إلى ربعها ومتطلبات SSD إلى ثمنها مقارنة بالجيل السابق، مما يخفض التكاليف لمهام نمط الوكلاء.
  • أظهرت اختبارات المعايير أن V4.1 Flash يتفوق في مستوى الذكاء على النماذج الرائدة بما في ذلك DeepSeek V4 Pro.
  • أصبح النموذج متاحًا الآن على واجهة برمجة تطبيقات ديب سيك تحت الاسم `deepseek-flash`، مع توجيه إصدارات V4 Flash الأقدم إليه مؤقتًا.
  • تم تعديل التسعير بمعدلات الذروة والذروة المنخفضة، وسيتم توجيه الطلبات إلى `deepseek-v4-pro` إلى V4.1 Flash بعد 14 سبتمبر 2026.

تهدف المعمارية الجديدة إلى توفير سقف قدرة أعلى، واستدلال أسرع، وإنتاجية أكبر، وقابلية للتوسع للنماذج ذات المعاملات الأكبر مع خدمة المزيد من المستخدمين بتكلفة أقل.