La versión llama.cpp b10080 aborda dos errores específicos en los componentes del servidor y la interfaz de usuario. El servidor ahora devuelve correctamente un código de estado 400 en lugar de fallar con un error 500 cuando la validación falla para solicitudes que contienen el encabezado X-Conversation-Id. Además, la UI ya no envía el marcador backend_sampling, lo que anteriormente provocaba que las completaciones con configuración predeterminada fallaran la validación.

  • Servidor: Corrige un fallo de std::bad_function_call manejando next_orig vacío en on_complete() cuando se omite set_next() durante los errores de validación.
  • Servidor: Evita sesiones instaladas por set_req() para solicitudes fallidas para prevenir fugas de recursos y problemas de descubrimiento.
  • UI: Protege el campo backend_sampling con hasValue() para filtrar marcadores de cadena vacía mientras preserva los valores false explícitos.

Estos cambios mejoran la estabilidad al prevenir caídas del servidor ante entradas no válidas y asegurar que las configuraciones predeterminadas se transmitan correctamente desde el cliente.