Le projet llama.cpp a publié la version b10254, introduisant un nouveau template de chat pour le modèle DeepSeek V4 Flash 0731 ainsi que des mises à jour des templates DeepSeek V4 existants.
- Aligner les templates DeepSeek V4 avec les encodeurs officiels tout en excluant les changements de comportement du parseur.
- Par défaut, supprimer l'historique de réflexion pour DeepSeek V4 sauf si preserve_reasoning est demandé ou que des outils sont présents.
- Ajouter des instructions de format de réponse pour la sortie structurée et passer les schémas dans le rendu du template.
- Introduire un template Flash 0731 séparé pour gérer les mappages mis à jour des efforts de raisonnement élevé et maximal.
- Inclure des correctifs pour la consommation du séparateur d'appel d'outil du parseur DSML et la sélection du template deepseek v4 0731.
Cette mise à jour assure la compatibilité avec les dernières spécifications du modèle DeepSeek et améliore la gestion de la sortie structurée.