DeepSeek выпустила свою новую модель DeepSeek V4-1 Flash. Это мультимодельная Mixture-of-Experts (MoE) модель с базовой архитектурой на 552 миллиарда параметров.
- Модель поддерживает контексты до одного миллиона токенов.
- Она использует мультимодельную архитектуру Mixture-of-Experts с 552B параметрами.