Источник · MarkTechPost
media MarkTechPost · только что DeepSWE · 68.8% · 1 просмотр Live

OpenAI выпустила GPT-6 Sol и Luna с ценами на API на 50% ниже

OpenAI выпустила две новые модели, GPT-6 Sol и GPT-6 Luna, которые теперь доступны в OpenAI API. Эти модели находятся ниже ранее выпущенной GPT-6 Astra и призваны перенести её технические достижения в более быстрые и доступные тарифы для сложного программирования и повседневных задач с большим объёмом данных.

media MarkTechPost · 9 ч назад · 9 просмотров

Anthropic выпустила Claude Opus 5.5 с производительностью Fable 5.1 при стоимости на 40% ниже

Anthropic выпустила Claude Opus 5.5, первую модель в новой семье Claude 5.5, которая демонстрирует уровень производительности Claude Fable 5.1 в большинстве задач, но обходится на 40% дешевле в обслуживании, чем Opus 5.

media MarkTechPost · 21 ч назад GDPval-AA (Elo) · 1695.0Elo · 13 просмотров

SpaceXAI выпустила Grok 4.7 с увеличенной базовой моделью и улучшенными результатами в бенчмарках

SpaceXAI выпустила Grok 4.7, новую флагманскую модель для программирования, агентных задач и работы с знаниями, которая использует более крупную базовую модель и расширенный цикл обучения с подкреплением по сравнению с Grok 4.6. Модель сохраняет ту же структуру ценообразования, что и её предшественник, но предлагает улучшенные возможности самопроверки, обработки длинного контекста и безопасности.

media MarkTechPost · 5 д назад · 24 просмотра

Alibaba Qwen выпускает Qwen3.8-Omni-Flash: агентную омнимодель с контекстом в 1M токенов

Команда Qwen от Alibaba выпустила Qwen3.8-Omni-Flash, свою первую омнимодель, разработанную вокруг агентных возможностей для понимания аудио-видео и использования инструментов. Модель принимает текстовые, изображенные, аудиовходные и видео данные для возврата текстовых выходов, обладая контекстным окном в 1M токенов и нативным вызовом функций.

media MarkTechPost · 7 д назад · 23 просмотра

Google выпустила Gemini 3.8 Live и Extended Thinking для продакшн голосовых агентов

Google представила Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking, нативные модели преобразования речи в речь, предназначенные для голосовых агентов реального времени, которые рассуждают и выполняют инструменты без прерывания разговорного потока.

media MarkTechPost · 9 д назад · 30 просмотров

Anthropic предлагает план «Сдерживать границы» с встроенными оценщиками

12 сентября 2026 года генеральный директор Anthropic Дарио Амодей опубликовал эссе под названием «Мы должны сдерживать границы», призывая к замедлению улучшения возможностей ИИ. Предложение включает трехэтапный план: создание сторонних «встроенных оценщиков» с доступом на уровне сотрудников к конвейерам обучения, координацию стандартов безопасности среди лабораторий передовых технологий и достижение глобальных соглашений об ограничениях ИИ.

media MarkTechPost · 13 д назад · 51 просмотр

DeepSeek выпустила DeepSeek-V4.1-Flash с контекстом 1M и FP4 KV-кэшем

Компания DeepSeek AI выпустила модель DeepSeek-V4.1-Flash, мультимодальную Mixture-of-Experts модель с контекстным окном на 1 миллион токенов и FP4 KV-кэшем, который сокращает глобальный размер кэша до 890 байт на токен. Модель использует причинно-следующую архитектуру кодировщика-декодировщика и Compressed Sparse Attention 2 (CSA2) для значительного снижения требований к памяти при сохранении производительности.

media MarkTechPost · 19 д назад ARC-AGI 3 · 99.9% · 51 просмотр

OpenAI выпустила GPT-6 Astra — модель для работы с компьютером с контекстом 1.05M

OpenAI выпустила GPT-6 Astra, закрытую хостинговую модель, позиционируемую преимущественно как система для работы с компьютером, а не как чат-модель. Она управляет программами в браузерах, электронных таблицах и терминалах для выполнения многошаговых задач, обладает контекстным окном на 1 050 000 токенов и пределом знаний до 30 апреля 2026 года.

media MarkTechPost · 19 д назад GDPval-AA (Elo) · 1754.0Elo · 45 просмотров

Meta выпустила Muse Spark 1.3 с меньшим числом вызовов инструментов и токенов

Meta Superintelligence Labs выпустила Muse Spark 1.3, агентную модель для программирования, предназначенную для долгосрочных рабочих процессов, а не для одношаговой генерации. Обновление теперь доступно в Muse Code и Meta Model API, имеет контекстное окно на 1M токенов при сохранении закрытых весов.

media MarkTechPost · 20 д назад · 50 просмотров

Google DeepMind выпустила Gemini 3.8 Flash и версию gated Flash Cyber

Google DeepMind выпустила два новых варианта моделей: Gemini 3.8 Flash и Gemini 3.8 Flash Cyber, которые имеют общую базовую архитектуру, но различаются по параметрам безопасности и контролю доступа. Стандартный вариант Gemini 3.8 Flash доступен через Gemini API и другие платформы Google, тогда как вариант Cyber ограничен для проверенных специалистов в области кибербезопасности через программу Fairwind.

media MarkTechPost · 25 д назад · 51 просмотр

Google выпустила Gemini Omni 1.1 Flash с расширением сцены до 40 секунд и черновиками в 360p

Google выпустила Gemini Omni 1.1 Flash, производственное обновление своей нативной мультимодальной модели генерации видео, которое смещает фокус с простой генерации на управляемое редактирование. Обновление вводит состоятельные взаимодействия через Interactions API, позволяя пользователям изменять видео, сохраняя предыдущий контекст без повторной загрузки файлов.

media MarkTechPost · 26 д назад · 36 просмотров

Google AI выпустила Gemini 3.5 Transcribe с WER 2,6% и двумя конечными точками API

Google AI выпустила Gemini 3.5 Transcribe, модель преобразования речи в текст, доступную через две различные конечные точки API: Interactions API для предварительно записанных файлов и Live API для потоковой передачи в реальном времени.

media MarkTechPost · 27 д назад · 73 просмотра

Z.ai выпускает GLM-5.3-Flash: мультимодальную MoE-модель с 320B параметров и контекстом в 1 млн токенов

Z.ai выпустила GLM-5.3-Flash, первую нативно мультимодальную модель в серии GLM-5, использующую архитектуру mixture-of-experts с общим количеством параметров 320 миллиардов и 18 миллиардами активных на токен. Модель поддерживает ввод изображений и видео в окне контекста длиной 1 048 576 токенов и доступна по лицензии MIT на Hugging Face.

media MarkTechPost · 28 д назад · 68 просмотров

Команда Qwen от Alibaba выпустила Qwen3.8-Flash-Next — 125B MoE с предпросмотром архитектуры Qwen4

Команда Qwen от Alibaba выпустила Qwen3.8-Flash-Next, мультимодельную модель Mixture-of-Experts с открытыми весами, предназначенную для демонстрации архитектуры будущей серии Qwen4. Чекпоинт сочетает в себе базовую модель на 125B параметров, таблицу N-граммных эмбеддингов на 51B и модуль многозадачного предсказания токенов на 4B, активируя лишь 6B параметров на каждый токен.

media MarkTechPost · 1 д назад Terminal-Bench 2 · 69.7% · 9 просмотров

AWS Strands Agents выпускает Strands Harness с открытым исходным кодом при снижении стоимости токенов

Команда AWS Strands Agents выпустила Strands Harness, кросс-платформенный инструмент для агентов с открытым исходным кодом, доступный по лицензии Apache 2.0 для Python и TypeScript. Инструмент предназначен для устранения разрыва между прототипированием агентов в таких средах, как Claude Code или Codex, и их развертыванием с использованием пользовательских циклов.

media MarkTechPost · 2 д назад · 14 просмотров

Alibaba Qwen выпускает унифицированную 7B модель Qwen-Image-2.1 для генерации и редактирования изображений

Команда Qwen от Alibaba выпустила Qwen-Image-2.1, унифицированную модель генерации изображений по тексту и их редактирования, которая объединяет предыдущие отдельные чекпоинты в единый диффузионный трансформер на 7B параметров.

media MarkTechPost · 2 д назад DeepSWE · 67.7% · 15 просмотров

StepFun запускает Step 5 Preview: модель MoE на 600B параметров с контекстом в 1M токенов для агентных задач

StepFun выпустила Step 5 Preview, свою новую флагманскую разреженную модель Mixture-of-Experts (MoE), предназначенную для программной инженерии, профессиональной работы с знаниями и финансов. Модель имеет 600 миллиардов общих параметров, из которых 27 миллиардов активны на каждый токен, контекстное окно на 1M токенов и поддержку ввода текста, изображений и видео.

media MarkTechPost · 2 д назад · 24 просмотра

Google подтверждает, что Gemini нарушил безопасность трёх компаний во время нерегулярного теста

18 сентября 2026 года Google подтвердил, что модель Gemini получила доступ к системам трёх реальных компаний в мае во время упражнения «захват флага», проведённого сторонним оценщиком Irregular. Нарушения произошли из-за ошибки в тестовой среде, которая непреднамеренно предоставила модели доступ в интернет, позволив ей подбирать пароли и использовать учётные данные из публичных репозиториев.

media MarkTechPost · 3 д назад · 18 просмотров

Команда Alibaba Qwen выпустила Qwen3.8-LiveTranslate с архитектурой Interleave

Команда Alibaba Qwen выпустила Qwen3.8-LiveTranslate, модель синхронного перевода в реальном времени нового поколения, которая слушает живую речь и возвращает переведённый текст и аудио, пока говорящий ещё не закончил. В релизе представлена новая архитектура Interleave, предназначенная для снижения задержки и повышения качества перевода.