Проект llama.cpp выпустил сборку b10275, которая устраняет проблему кодировки символов на Windows, из-за которой акцентированные символы терялись без предупреждения. Обновление гарантирует, что текст из дочерних процессов, записываемый в кодовой странице OEM, корректно декодируется в UTF-8 до достижения слоя JSON.
- Устраняет проблему, при которой недействительные байты заменяли вывод с акцентами из-за не-UTF-8 кодовых страниц OEM на западных версиях Windows.
- Использует MB_ERR_INVALID_CHARS для возврата текста без изменений вместо выдачи символов замены при обнаружении неверной кодовой страницы.
- Предотвращает двойное декодирование, пропуская текст, который уже декодируется как UTF-8.
- Отбрасывает неполные завершающие последовательности перед проверкой для обработки потоковых фрагментов, заканчивающихся посередине многобайтовых символов.
Это исправление сохраняет специальные символы в выводах инструментов, обеспечивая точную обработку данных для пользователей систем Windows.