Le projet llama.cpp a publié la version b10254, introduisant un nouveau template de chat pour le modèle DeepSeek V4 Flash 0731 ainsi que des mises à jour des templates DeepSeek V4 existants.

  • Aligner les templates DeepSeek V4 avec les encodeurs officiels tout en excluant les changements de comportement du parseur.
  • Par défaut, supprimer l'historique de réflexion pour DeepSeek V4 sauf si preserve_reasoning est demandé ou que des outils sont présents.
  • Ajouter des instructions de format de réponse pour la sortie structurée et passer les schémas dans le rendu du template.
  • Introduire un template Flash 0731 séparé pour gérer les mappages mis à jour des efforts de raisonnement élevé et maximal.
  • Inclure des correctifs pour la consommation du séparateur d'appel d'outil du parseur DSML et la sélection du template deepseek v4 0731.

Cette mise à jour assure la compatibilité avec les dernières spécifications du modèle DeepSeek et améliore la gestion de la sortie structurée.