Le laboratoire de recherche Qwen d'Alibaba a publié Qwen 3.8 27B, un LLM capable de vision qui surpasse son prédécesseur et le Qwen 3.7-Plus à poids fermés dans les benchmarks auto-déclarés.

Le modèle utilise par défaut un niveau d'effort de raisonnement 'xhigh', ce qui lui fait sur-analyser des prompts simples et consommer excessivement de tokens de contexte.

Les tests montrent que la désactivation ou la réduction de ce réglage de raisonnement améliore significativement la vitesse et la pertinence de la sortie pour les tâches d'inférence locale.