Le projet llama.cpp a publié la compilation b10275, qui corrige un problème d'encodage de caractères sur Windows où les caractères accentués étaient perdus silencieusement. La mise à jour garantit que le texte des processus enfants écrivant dans la page de codes OEM est correctement décodé en UTF-8 avant d'atteindre la couche JSON.

  • Résout un problème où des octets invalides remplaçaient la sortie accentuée en raison de pages de codes OEM non UTF-8 sur les installations occidentales de Windows.
  • Utilise MB_ERR_INVALID_CHARS pour retourner le texte intact au lieu d'émettre des caractères de remplacement lorsqu'une page de codes incorrecte est détectée.
  • Empêche le double décodage en laissant passer le texte qui est déjà décodé comme UTF-8.
  • Supprime les séquences finales incomplètes avant la validation pour gérer les chunks diffusés se terminant au milieu de caractères multioctets.

Cette correction préserve les caractères spéciaux dans les sorties des outils, garantissant une manipulation précise des données pour les utilisateurs sur les systèmes Windows.