Le projet llama.cpp a mis à jour son composant serveur pour prendre en charge l'entrée visuelle pour le modèle Clef. Ce changement fait partie de la pull request #29969.

  • Ajout du support d'entrée visuelle pour Clef.
  • Déplacement de input_attn_causal vers privé.
  • Extension de l'ancien server_batch::embd.
  • Changement de server_batch::token::pos en multidimensionnel.
  • Correction de la gestion des aborts.
  • Correction de la limite de tokens d'image.
  • Correction du problème de mutation de données dans yield_to_queue.