A versão llama.cpp b10080 aborda dois bugs específicos nos componentes do servidor e da interface do usuário. O servidor agora retorna corretamente um código de status 400 em vez de falhar com um erro 500 quando a validação falha para solicitações contendo o cabeçalho X-Conversation-Id. Além disso, a UI não envia mais o placeholder backend_sampling, que anteriormente causava falhas na validação de conclusões com configurações padrão.

  • Servidor: Corrige uma falha de std::bad_function_call manipulando next_orig vazio em on_complete() quando set_next() é ignorado durante erros de validação.
  • Servidor: Evita sessões instaladas por set_req() para solicitações falhas para prevenir vazamentos de recursos e problemas de descoberta.
  • UI: Protege o campo backend_sampling com hasValue() para filtrar placeholders de strings vazias enquanto preserva valores false explícitos.

Essas alterações melhoram a estabilidade, prevenindo falhas do servidor em entradas inválidas e garantindo que as configurações padrão sejam transmitidas corretamente do cliente.