Un utilisateur signale l'exécution du modèle Qwen 3.8 27B avec la quantification GGUF UD-Q5_K_M et un profil d'effort de raisonnement xhigh pour des tâches de codage intensives utilisant OpenCode.

  • Le moteur de raisonnement du modèle fournit une analyse architecturale approfondie mais fonctionne lentement lors de boucles de réflexion prolongées.
  • Des générations lourdes soutenues sur plus de 10 heures quotidiennes poussent une AMD Radeon RX 7900 XT à environ 90°C.
  • L'utilisateur maintient la stabilité grâce à un environnement de gestion du contexte personnalisé pour les limites de tokens.

L'article met en évidence l'impact thermique des charges de travail de raisonnement de longue durée sur le matériel grand public, invitant d'autres personnes à partager leurs expériences de température et de throttling.