La version llama.cpp b10080 traite deux bugs spécifiques dans les composants du serveur et de l'interface utilisateur. Le serveur renvoie désormais correctement un code d'état 400 au lieu de planter avec une erreur 500 lorsque la validation échoue pour les requêtes contenant l'en-tête X-Conversation-Id. De plus, l'interface utilisateur n'envoie plus le placeholder backend_sampling, qui provoquait précédemment l'échec de la validation des complétions par défaut.
- Serveur : Corrige un plantage std::bad_function_call en gérant next_orig vide dans on_complete() lorsque set_next() est ignoré lors d'erreurs de validation.
- Serveur : Évince les sessions installées par set_req() pour les requêtes échouées afin de prévenir les fuites de ressources et les problèmes de découverte.
- Interface utilisateur : Protège le champ backend_sampling avec hasValue() pour filtrer les placeholders de chaînes vides tout en préservant les valeurs false explicites.
Ces modifications améliorent la stabilité en empêchant les plantages du serveur sur des entrées invalides et en garantissant que les paramètres par défaut sont correctement transmis depuis le client.