Выпуск llama.cpp b10080 устраняет две конкретные ошибки в компонентах сервера и пользовательского интерфейса. Сервер теперь корректно возвращает код статуса 400 вместо сбоя с ошибкой 500, когда проверка не проходит для запросов, содержащих заголовок X-Conversation-Id. Кроме того, UI больше не отправляет заполнитель backend_sampling, который ранее приводил к отказу валидации при завершении по умолчанию.

  • Сервер: Исправляет сбой std::bad_function_call путем обработки пустого next_orig в on_complete(), когда set_next() пропускается из-за ошибок валидации.
  • Сервер: Удаляет сессии, установленные через set_req() для неудачных запросов, чтобы предотвратить утечки ресурсов и проблемы обнаружения.
  • UI: Защищает поле backend_sampling с помощью hasValue(), чтобы отфильтровать заполнители пустых строк, сохраняя при этом явные значения false.

Эти изменения повышают стабильность, предотвращая сбои сервера при некорректном вводе и обеспечивая правильную передачу настроек по умолчанию от клиента.