Laporan Teknis Qwen3 menyajikan versi terbaru dari keluarga model Qwen, dengan arsitektur padat dan Mixture-of-Expert (MoE) serta skala parameter dari 0,6 hingga 235 miliar. Inovasi utamanya adalah integrasi mode berpikir untuk penalaran kompleks dan mode tanpa berpikir untuk respons cepat ke dalam satu kerangka kerja terpadu, sehingga menghilangkan kebutuhan untuk beralih antar model yang berbeda.

  • Qwen3 memperkenalkan mekanisme anggaran berpikir yang memungkinkan pengguna mengalokasikan sumber daya komputasi secara adaptif selama inferensi untuk menyeimbangkan latensi dan kinerja.
  • Seri model ini mencapai hasil terbaik di berbagai benchmark, termasuk generasi kode, penalaran matematika, dan tugas agen.
  • Dukungan multibahasa diperluas dari 29 menjadi 119 bahasa dan dialek dibandingkan dengan pendahulunya Qwen2.5.
  • Semua model Qwen3 tersedia secara publik di bawah lisensi Apache 2.0 untuk memfasilitasi reproduktibilitas dan penelitian yang digerakkan oleh komunitas.

Pendekatan terpadu ini memungkinkan pengalihan mode dinamis berdasarkan kueri pengguna, sementara dukungan bahasa yang diperluas meningkatkan aksesibilitas global melalui pemahaman lintas-bahasa yang lebih baik.