Новая модель DeepSeek V4-Flash набрала 50 баллов в индексе ArtificialAnalysis. Этот результат ставит её всего на один балл ниже GLM-5.2 и GPT-5.6 Luna.
DeepSeek V4-Flash достиг 50 баллов в индексе ArtificialAnalysis
Бенчмарки
| Бенчмарк | Модель | Результат |
|---|---|---|
| Artificial Analysis Intelligence Index | DeepSeek V4-Flash | 50% |
Сравнение Kimi K3, DeepSeek V4 Pro и GLM-5.2 по бенчмаркам, лицензии и стоимости обслуживания
Сравнение трёх моделей с открытыми весами на основе разреженного Mixture-of-Experts — Kimi K3 от Moonshot AI, DeepSeek V4 Pro и GLM-5.2 от Zhipu AI — оценивает их возможности, условия лицензирования и стоимость обслуживания для задач программирования и работы агентов с длинным горизонтом.
Чарли О'Нилл из Base-10 утверждает, что Kimi и GLM лучше Opus 5
Чарли О'Нилл из Base-10 обсуждает, почему модели Kimi и GLM «почти объективно» превосходят Opus 5 в недавнем эпизоде с участием Дваркеша Пателя.
DeepSeek V4.1 Flash возглавил Индекс интеллекта Artificial Analysis v4.3
DeepSeek V4.1 Flash занял первое место в новом бенчмарке Astra в обновлении Индекса интеллекта Artificial Analysis v4.3.
LiveBench добавляет DeepSeek v4.1 Flash
Платформа бенчмаркинга LiveBench добавила модель DeepSeek v4.1 Flash в свой набор для оценки.
Дистилляция GLM-5.3 Flash жертвует надёжностью ради снижения стоимости в 17 раз
Сравнение GLM-5.3 и её дистиллированной версии GLM-5.3 Flash на бенчмарке DeepSWE показывает, что дистилляция сохраняет базовые способности к программированию, значительно снижая стоимость генерации ответов. Полная модель достигает показателя pass@1 на уровне 69,0% при стоимости $3,99 за задачу, тогда как версия Flash набирает 63,4% всего за $0,24, что представляет собой снижение цены в 17 раз.