DeepSeek запустила DeepSeek v4.1-Flash, новую флагманскую модель с открытыми весами, использующую новую причинную архитектуру кодировщика-декодатора, разработанную для максимизации эффективности вывода и снижения затрат.

Модель использует структуру смеси экспертов (MoE) с общим количеством 763 миллиарда параметров, но активирует только 8B параметров для обработки входных данных и 16B для генерации выходных. Такая конструкция обеспечивает разреженность на уровне 1-2% и уменьшает объем KV-кэша до одной восьмой части по сравнению с предыдущей моделью V4 Flash. Она поддерживает контекстное окно объемом 1M токенов с текстовыми и визуальными входами под лицензией MIT.

Независимые бенчмарки от Artificial Analysis и Vals ставят v4.1-Flash на первое место среди моделей с открытыми весами, отмечая ее превосходное соотношение цены и качества при стоимости $0.30 за миллион входных токенов.