El proyecto llama.cpp lanzó la compilación b10275, que corrige un problema de codificación de caracteres en Windows donde los caracteres acentuados se perdían silenciosamente. La actualización asegura que el texto de procesos hijos que escriben en la página de códigos OEM se decodifique correctamente a UTF-8 antes de llegar a la capa JSON.

  • Resuelve un problema donde bytes inválidos reemplazaban la salida acentuada debido a páginas de códigos OEM no UTF-8 en instalaciones occidentales de Windows.
  • Usa MB_ERR_INVALID_CHARS para devolver el texto intacto en lugar de emitir caracteres de reemplazo cuando se detecta una página de códigos incorrecta.
  • Previene la doble decodificación pasando a través del texto que ya se decodifica como UTF-8.
  • Descarta secuencias finales incompletas antes de la validación para manejar fragmentos transmitidos que terminan en medio de caracteres multibyte.

Esta corrección preserva los caracteres especiales en las salidas de herramientas, asegurando un manejo preciso de datos para usuarios en sistemas Windows.