DeepSeek выпустила V4.1-Flash, новую флагманскую модель с открытыми весами, предназначенную для экстремальной эффективности вывода и низкой стоимости. Модель использует причинную архитектуру энкодер-декодер для значительного снижения активных вычислений и затрат на KV/кэш.

  • Она набирает 40 баллов в Индексном индексе искусственного интеллекта Artificial Analysis, превосходя DeepSeek V4 Pro 0813 при стоимости $0.30 за 1M входных токенов.
  • Архитектура включает 763B общих параметров, из которых только 8B активны для ввода и 16B активны для вывода.
  • Она поддерживает контекстное окно на 1M токенов и принимает как текстовые, так и изображений входные данные под лицензией MIT.
  • Независимые оценки показывают, что она делит с GPT-6 Astra первое место на AutomationBench-AA с результатом 69% и соответствует GPT-5.6 Sol на AA-LCR v1.1 с результатом 84%.
  • Пользователи сообщают о запуске модели локально на стандартном оборудовании, достигая высокой пропускной способности благодаря потоковой передаче через SSD и выгрузке.

Выпуск позиционирует V4.1-Flash как экономически эффективную альтернативу проприетарным моделям, предлагая сильные показатели производительности за долю цены.