O projeto llama.cpp lançou a compilação b10275, que corrige um problema de codificação de caracteres no Windows onde caracteres acentuados eram perdidos silenciosamente. A atualização garante que o texto de processos filhos escrevendo na página de códigos OEM seja decodificado corretamente para UTF-8 antes de alcançar a camada JSON.
- Resolve um problema onde bytes inválidos substituíam a saída acentuada devido a páginas de códigos OEM não UTF-8 em instalações ocidentais do Windows.
- Usa MB_ERR_INVALID_CHARS para retornar o texto intacto em vez de emitir caracteres de substituição quando uma página de códigos errada é detectada.
- Previne a dupla decodificação passando pelo texto que já é decodificado como UTF-8.
- Descarta sequências finais incompletas antes da validação para lidar com chunks transmitidos que terminam no meio de caracteres multibyte.
Esta correção preserva caracteres especiais nas saídas das ferramentas, garantindo o manuseio preciso de dados para usuários em sistemas Windows.