Лаборатория · DeepSeek
lab DeepSeek API Docs · 9 д назад Terminal-Bench 2 · 82.7% · 7 просмотров

DeepSeek выпускает DeepSeek-V4-Flash в публичную бета-версию с улучшенными возможностями агента

DeepSeek запустила официальную публичную бета-версию API DeepSeek-V4-Flash, которая предлагает значительно расширенные возможности агента по сравнению с V4-Pro-Preview. Обновление включает повторное дообучение модели при сохранении её исходной архитектуры и размера.

media Together AI Blog · 2 д назад DeepSWE · 67.2% · 7 просмотров

DeepSeek-V4 Flash 0731 против GPT-5.6 Luna на DeepSWE: стоимость и программирование

Сравнение моделей DeepSeek-V4 Flash 0731 и GPT-5.6 Luna на бенчмарке DeepSWE показывает, что, хотя GPT-5.6 Luna является более сильным инженером, каскадная стратегия с использованием обеих моделей обеспечивает более высокую точность при меньшей стоимости.

media TLDR AI · 5 д назад · 7 просмотров

Исследователи OpenAI решили десять математических задач; выпущен Qwen 3.8-Max

OpenAI опубликовала результаты, полученные при оценке неназванной модели, решив или существенно продвинувшись в решении давних открытых проблем в математике и теоретической информатике. Одновременно с этим стала доступна модель Qwen 3.8-Max с 2,4 триллиона параметров, обеспечивающая улучшения в области программирования, работы, исследований и задач с длинным горизонтом.

media AI News (smol.ai) · 8 д назад Terminal-Bench 2 · 79.0% · 13 просмотров

DeepSeek выпустила V4-Flash с существенными улучшениями после дообучения и открытыми весами

DeepSeek запустила API DeepSeek-V4-Flash в публичную бета-версию и сразу же опубликовала его веса под лицензией MIT. Обновление обеспечивает значительный рост производительности по сравнению с апрельской превью-версией без изменения архитектуры или размера модели, позиционируя её как экономичную альтернативу проприетарным моделям.

media r/LocalLLaMA · 9 д назад · 13 просмотров

Обновление DeepSeek V4 Flash с улучшенными результатами в Terminal Bench и Toolathlon

DeepSeek обновил свою модель V4 Flash, выпустив новую версию 2026-07-31, которая демонстрирует значительный рост производительности по сравнению с предыдущей предварительной версией. Обновление включает результаты нескольких новых бенчмарков, а также улучшает показатели в существующих.

media The Batch · 2 д назад Code Arena (Elo) · 1577.0Elo · 1 просмотр

DeepSeek выпустила V4-Flash-0731, превосходящую V4-Pro при меньшей стоимости

DeepSeek выпустила DeepSeek-V4-Flash-0731, обновленную версию своей более легкой модели "Flash", которая превосходит более крупную DeepSeek-V4-Pro в независимых бенчмарках. Выпуск использует новый процесс тонкой настройки, сохраняя оригинальную архитектуру Mixture-of-Experts с 284 миллиардами общих параметров.

media Latent Space · 8 д назад Terminal-Bench 2 · 79.0% · 4 просмотра

DeepSeek выпустила V4-Flash с улучшениями после дообучения и открытыми весами

DeepSeek выпустила обновлённую публичную бета-версию API для DeepSeek-V4-Flash одновременно с открытием доступа к весам модели, что ознаменовало значительный скачок производительности, достигнутый за счёт дообучения, а не изменений архитектуры. Модель сохраняет структуру из 284B общих и 13B активных параметров, но демонстрирует существенные улучшения в агентных возможностях и результатах на бенчмарках для программирования.

media MarkTechPost · 8 д назад Terminal-Bench 2 · 82.7% · 9 просмотров

DeepSeek выпустила V4-Flash-0731 с существенными улучшениями агентных способностей при снижении стоимости

DeepSeek опубликовала официальную модель DeepSeek-V4-Flash-0731 на Hugging Face и перевела свой API в публичную бета-версию начиная с 31 июля 2026 года. Этот релиз заменяет предыдущую превью-версию за счёт повторного дообучения, а не архитектурных изменений, обеспечивая значительные улучшения в агентных и кодинговых бенчмарках при сохранении того же размера в 284B параметров.

media r/LocalLLaMA · 8 д назад · 1 просмотр

DeepSeek V4 Flash выпущен как высокопроизводительная и недорогая модель с открытыми весами

DeepSeek выпустила свою новую flash-модель DeepSeek V4 Flash, которая позиционируется как вторая по качеству среди моделей с открытыми весами после Kimi K3, предлагая при этом значительно более низкие цены. Модель стоит $0.09 за входные токены и $0.18 за выходные токены на миллион токенов.

media r/LocalLLaMA · 8 д назад · 9 просмотров

Первоначальное тестирование DeepSeek v4 Flash показывает значительные улучшения в возможностях дизайна UI/UX

Первоначальное тестирование модели DeepSeek v4 Flash указывает на заметные улучшения её навыков проектирования пользовательского интерфейса и пользовательского опыта. Несмотря на эти улучшения, отмечается, что модель потребляет много токенов.

media r/LocalLLaMA · 8 д назад · 3 просмотра

Модель DeepSeek v4 flash с открытыми весами, 284B общих и 13B активных параметров, вынуждает снижать цены

Переведенный мем, циркулирующий на Reddit, указывает на то, что конкуренту пришлось снизить цены на 80% из-за конкурентного давления со стороны DeepSeek v4 flash. Эта модель с открытыми весами имеет 284 миллиарда общих параметров и 13 миллиардов активных параметров, обеспечивая превосходные показатели соотношения цены и производительности.