DeepSeek выпустила свою новую модель DeepSeek V4-1 Flash. Это мультимодельная Mixture-of-Experts (MoE) модель с базовой архитектурой на 552 миллиарда параметров.

  • Модель поддерживает контексты до одного миллиона токенов.
  • Она использует мультимодельную архитектуру Mixture-of-Experts с 552B параметрами.