DeepSeek выпустила V4.1-Flash, новую флагманскую модель с открытыми весами, предназначенную для экстремальной эффективности вывода и низкой стоимости. Модель использует причинную архитектуру энкодер-декодер для значительного снижения активных вычислений и затрат на KV/кэш.
- Она набирает 40 баллов в Индексном индексе искусственного интеллекта Artificial Analysis, превосходя DeepSeek V4 Pro 0813 при стоимости $0.30 за 1M входных токенов.
- Архитектура включает 763B общих параметров, из которых только 8B активны для ввода и 16B активны для вывода.
- Она поддерживает контекстное окно на 1M токенов и принимает как текстовые, так и изображений входные данные под лицензией MIT.
- Независимые оценки показывают, что она делит с GPT-6 Astra первое место на AutomationBench-AA с результатом 69% и соответствует GPT-5.6 Sol на AA-LCR v1.1 с результатом 84%.
- Пользователи сообщают о запуске модели локально на стандартном оборудовании, достигая высокой пропускной способности благодаря потоковой передаче через SSD и выгрузке.
Выпуск позиционирует V4.1-Flash как экономически эффективную альтернативу проприетарным моделям, предлагая сильные показатели производительности за долю цены.