O projeto llama.cpp lançou a compilação b11136, que atualiza o llama-server para aceitar o tipo de conteúdo "video_url" padrão da OpenAI para entradas de vídeo. Anteriormente, o servidor aceitava apenas um tipo não padrão "input_video" e rejeitava URIs de dados, causando problemas de compatibilidade com clientes conformes à OpenAI.

  • Aceita "video_url" como alias para "input_video" na API de conclusões de chat.
  • Lê objetos de mídia a partir de qualquer chave para garantir compatibilidade retroativa.
  • Permite URIs data: para conteúdo de vídeo (data:video/*), espelhando o suporte existente para imagens.
  • Fornece binários para macOS, Linux, Windows, Android e openEuler em backends de CPU, GPU e NPU.

Esta alteração permite que clientes compatíveis com a OpenAI enviem dados de vídeo para o llama-server sem encontrar erros de tipo de conteúdo não suportado.