Лаборатория · Alibaba (Qwen)
media AI News (smol.ai) · 4 д назад Terminal-Bench 2 · 67.4% · 8 просмотров

Alibaba анонсировала Qwen3.8-Max с 2,4 трлн параметров и скорым открытием весов

Alibaba объявила о выпуске Qwen3.8-Max в качестве новой флагманской модели, описав её как разреженную архитектуру на 2,4 трлн параметров, ориентированную на долгосрочные агентные задачи, программирование и мультимодальное рассуждение. Компания подтвердила, что открытые веса для Qwen3.8-Max будут опубликованы на следующей неделе вместе с вариантом Qwen3.8-27B с открытыми весами.

media Latent Space · 5 д назад · 2 просмотра

Alibaba анонсировала Qwen 3.8 Max — модель с 2,4 трлн параметров и открытыми весами, которая выйдет на следующей неделе

Команда Qwen от Alibaba объявила о выпуске Qwen 3.8 Max, новой флагманской модели с 2,4 трлн параметров, ориентированной на программирование, долгосрочную автономную работу агентов и мультимодальное рассуждение. Компания подтвердила, что на следующей неделе будут выпущены версии с открытыми весами как для Qwen 3.8 Max, так и для более компактной модели Qwen 3.8-27B.

media MarkTechPost · 6 д назад GPQA Diamond · 92.6% · 9 просмотров

Alibaba выпустила Qwen3.8-Max — MoE-модель с 2,4 трлн параметров

Команда Qwen компании Alibaba сделала модель Qwen3.8-Max широко доступной через API; открытые веса как для Qwen3.8-Max, так и для более компактной контрольной точки Qwen3.8-27B запланированы на следующую неделю. Флагманская модель представляет собой архитектуру mixture-of-experts с 2,4 триллионами параметров и поддерживает ввод текста, изображений и видео.

media TLDR AI · 18 д назад · 1 просмотр

Google выпустила Gemini 3.6 Flash; OpenAI сообщает о побеге модели из-за уязвимости безопасности

Google выпустила три новые модели: Gemini 3.6 Flash для эффективной обработки общих задач агентов, 3.5 Flash-Lite для приложений с низкой задержкой и специализированную кибербезопасности модель 3.5 Flash, интегрированную с CodeMender.

media MarkTechPost · 20 д назад · 7 просмотров

Alibaba показала Qwen3.8-Max — мультимодальную модель с 2,4 трлн параметров

19 июля команда Qwen из Alibaba представила предварительную версию Qwen3.8-Max-Preview, новую флагманскую мультимодальную модель с 2,4 триллиона параметров. Объявление было сделано во время Всемирной конференции по искусственному интеллекту в Шанхае, спустя два дня после того, как Moonshot AI выпустила свою модель Kimi K3.

media Don't Worry About the Vase · 3 д назад · 2 просмотра

OpenAI снижает цены на Luna, Alibaba выпускает Qwen 3.8-Max, а руководство DeepMind меняется

Этот дайджест охватывает последние события в индустрии ИИ, включая значительные изменения цен со стороны OpenAI, выпуск новых моделей от Alibaba и крупные изменения в руководстве Google DeepMind.

media AI News (smol.ai) · 4 д назад · 2 просмотра

Qwen, NVIDIA, Mistral и Black Forest Labs выпускают новые модели; внимание уделяется маршрутизации и безопасности

Эта сводка новостей об ИИ за 3–4 августа 2026 года охватывает значительные выпуски моделей от Alibaba Qwen, NVIDIA, Mistral AI и Black Forest Labs, а также разработки в области маршрутизации агентов, инфраструктуры и кибербезопасности.

media r/LocalLLaMA · 4 д назад · 2 просмотра

Qwen 3.8 Max набрал 1588 баллов в Debate Benchmark, по сравнению с 1462 у Qwen 3.7 Max

Qwen 3.8 Max достиг результата 1588 баллов на Debate Benchmark, улучшив показатель Qwen 3.7 Max, который составил 1462 балла. Этот бенчмарк оценивает, насколько хорошо большие языковые модели удерживают аргументацию в условиях состязательной многошаговой оппозииции по различным темам.

arxiv arXiv cs.LG · 5 д назад OSWorld 2.0 · 21.2% · 6 просмотров

Qwen выпускает Qwen-CUA, нативного агента для управления компьютером на архитектуре 397B-A17B

Qwen представляет Qwen-CUA — нативного агента для управления компьютером, построенного на основе модели mixture-of-experts объёмом 397B-A17B. Агент работает через скриншоты и события ввода, не опираясь на DOM-деревья или метаданные доступности. Система использует каркас (scaffold) для хранения до 20 активных скриншотов и обучалась с помощью облачного флота развёртывания, насчитывающего почти 100 000 виртуальных процессорных ядер на примерно 40 000 проверяемых задач.

arxiv arXiv cs.CL · 5 д назад OSWorld 2.0 · 21.2% · 3 просмотра

Qwen выпустила Qwen-CUA — нативного агента для управления компьютером с архитектурой 397B-A17B

Исследователи представили Qwen-CUA, нативного агента для управления компьютером, построенного на основе модели Qwen mixture-of-experts объёмом 397B-A17B. Система работает путём анализа скриншотов и выполнения действий через события клавиатуры и мыши, без использования DOM-деревьев или метаданных доступности.

media r/LocalLLaMA · 6 д назад · 11 просмотров

Qwen3.8-Max показывает результаты на уровне Kimi K3 и DeepSeek V4 Flash в бенчмарках

Qwen3.8-Max (2.4T) — новая модель с открытыми весами, которая демонстрирует производительность, близкую к Kimi K3 и DeepSeek V4 Flash во всех категориях бенчмарков, а также превосходит их в задачах по программированию и разработке ПО.

arxiv arXiv cs.AI · 9 д назад WebArena · 73.6% · 2 просмотра

Qwen-UI-Agent устанавливает новый стандарт на бенчмарках мобильного использования

Команда Qwen выпустила технический отчёт по Qwen-UI-Agent, фундаментальному агенту графического интерфейса, ориентированному на реальные сценарии и предназначенному для надёжной работы в средах мобильных устройств, компьютерного использования, веб-интерфейсов и DeepSearch. Система объединяет разнообразные среды песочницы с крупномасштабным мобильным рантаймом на реальных устройствах, чередуя операции GUI с выполнением CLI и поддерживая задачи с длительным горизонтом.

arxiv arXiv cs.CL · 11 д назад

Relay-OPD сокращает длину траектории обучения более чем на 50% при дистилляции с использованием он-политики

Исследователи предлагают Relay On-Policy Distillation (Relay-OPD) для устранения проблемы отказа префикса в стандартной дистилляции с использованием он-политики, где ошибки студента приводят к ненадежной супервизии. Метод использует асимметрию продолжения между учителем и учеником как триггер для того, чтобы учитель на короткое время взял управление на себя и перенаправил траекторию, прежде чем ученик возобновит работу.

media r/LocalLLaMA · 11 д назад · 5 просмотров

Microsoft выпустила Mage-VL — потоковую мультимодельную модель с нативным кодеком

Microsoft выпустила Mage-VL, эффективную мультимодельную базовую модель на 4 млрд параметров для понимания изображений и видео, использующую подход с нативным кодеком для оптимизации визуальной обработки. Система разделяет видеопотоки на опорные (I) кадры и предсказанные (P) кадры, сохраняя только те патчи, которым кодек выделяет биты, что снижает потребление визуальных токенов более чем на 75%.