Технический отчет Qwen3 описывает последнюю версию семейства моделей Qwen, включающую плотные архитектуры и архитектуру Mixture-of-Expert (MoE) с количеством параметров от 0,6 до 235 миллиардов. Ключевым нововведением является интеграция режима рассуждений для сложного логического вывода и режима без рассуждений для быстрых ответов в единую структуру, что устраняет необходимость переключения между различными моделями.

  • Qwen3 внедряет механизм бюджета рассуждений, позволяющий пользователям адаптивно распределять вычислительные ресурсы во время вывода для балансировки задержки и производительности.
  • Серия моделей демонстрирует лучшие результаты на разнообразных бенчмарках, включая генерацию кода, математическое логическое доказательство и задачи агентов.
  • Поддержка многоязычности расширяется с 29 до 119 языков и диалектов по сравнению с предыдущей версией Qwen2.5.

Все модели Qwen3 доступны публично под лицензией Apache 2.0 для обеспечения воспроизводимости и исследований, разрабатываемых сообществом.

Этот единый подход позволяет динамически переключать режимы в зависимости от запросов пользователя, а расширенная поддержка языков улучшает глобальную доступность за счет улучшенного кросс-лингвистического понимания.