DeepSeek опубликовала официальную модель DeepSeek-V4-Flash-0731 на Hugging Face и перевела свой API в публичную бета-версию начиная с 31 июля 2026 года. Этот релиз заменяет предыдущую превью-версию за счёт повторного дообучения, а не архитектурных изменений, обеспечивая значительные улучшения в агентных и кодинговых бенчмарках при сохранении того же размера в 284B параметров.
- Модель имеет архитектуру MoE на 284B параметров с активацией 13B на токен и включает модуль спекулятивного декодирования DSpark.
- Она демонстрирует более высокие результаты, чем V4-Pro (Preview), во всех опубликованных агентных бенчмарках, включая 82.7 на Terminal Bench 2.1 и 54.2 на NL2Repo.
- Тарификация API установлена на уровне $0.14 за 1M входных токенов и $0.28 за 1M выходных токенов, что примерно в три раза дешевле стоимости V4-Pro.
- Веса распространяются под лицензией MIT и не имеют ограничений доступа, позволяя разворачивать модель самостоятельно на памяти объёмом около 110 GB с квантованием или на ноде 4×GB300 для полной точности.
Обновление предоставляет экономически эффективное решение для циклов агентов и задач кодинга, предлагая производительность, сопоставимую с более дорогими моделями, оставаясь при этом доступной для независимых разработчиков и предприятий через API или самостоятельное развёртывание.