Qwen3 기술 보고서는 Qwen 모델 계열의 최신 버전을 소개하며, 0.6억에서 2350억 파라미터 규모에 이르는 밀집형과 전문가 혼합(MoE) 아키텍처를 특징으로 합니다. 주요 혁신은 복잡한 추론을 위한 사고 모드와 빠른 응답을 위한 비사고 모드를 통합된 프레임워크로 통합하여 서로 다른 모델 간 전환의 필요성을 제거한 것입니다.

  • Qwen3는 추론 중 지연 시간과 성능 균형을 위해 사용자가 컴퓨팅 자원을 적응적으로 할당할 수 있는 사고 예산 메커니즘을 도입합니다.
  • 이 모델 계열은 코드 생성, 수학 추론 및 에이전트 작업을 포함한 다양한 벤치마크에서 최상위 결과를 달성했습니다.
  • 다국어 지원은 전작인 Qwen2.5 대비 29개 언어와 방언에서 119개 언어와 방언으로 확장되었습니다.
  • 모든 Qwen3 모델은 재현성과 커뮤니티 기반 연구를 촉진하기 위해 Apache 2.0 라이선스 하에 공개적으로 접근 가능합니다.

이 통합 접근 방식은 사용자 쿼리에 기반한 동적 모드 전환을 가능하게 하며, 확장된 언어 지원은 향상된 교차 언어 이해를 통해 글로벌 접근성을 높입니다.