Le projet llama.cpp a publié la compilation b11136, qui met à jour llama-server pour accepter le type de contenu "video_url" standard d'OpenAI pour les entrées vidéo. Auparavant, le serveur n'acceptait qu'un type non standard "input_video" et rejetait les URIs de données, causant des problèmes de compatibilité avec les clients conformes à OpenAI.

  • Accepte "video_url" comme alias de "input_video" dans l'API de complétion de chat.
  • Lit les objets multimédias depuis n'importe quelle clé pour garantir la rétrocompatibilité.
  • Autorise les URIs data: pour le contenu vidéo (data:video/*), reflétant le support existant pour les images.
  • Fournit des binaires pour macOS, Linux, Windows, Android et openEuler sur les backends CPU, GPU et NPU.

Ce changement permet aux clients compatibles OpenAI d'envoyer avec succès des données vidéo à llama-server sans rencontrer d'erreurs de type de contenu non supporté.