Qwen3技術レポートは、Qwenモデルファミリーの最新バージョンを紹介しています。このバージョンでは、0.6億から2350億のパラメータ規模を持つ密集型およびMixture-of-Expert (MoE) アーキテクチャが特徴です。重要な革新として、複雑な推論用の思考モードと迅速な応答用の非思考モードを統合フレームワークに統合し、異なるモデル間の切り替えを不要にしました。

  • Qwen3は、推論中にユーザーが計算リソースを適応的に割り当ててレイテンシとパフォーマンスのバランスを取れるようにする思考予算メカニズムを導入しています。
  • このモデルシリーズは、コード生成、数学的推論、エージェントタスクを含む多様なベンチマークで最先端の結果を達成しています。
  • 前世代のQwen2.5と比較して、多言語サポートが29言語から119言語および方言に拡大しました。
  • Qwen3のすべてのモデルは、再現性とコミュニティ主導の研究を促進するためにApache 2.0ライセンスの下で公開アクセス可能です。

この統合アプローチにより、ユーザーのクエリに基づいた動的なモード切り替えが可能になり、拡張された言語サポートは改善された異言語理解を通じてグローバルなアクセシビリティを向上させます。