O projeto llama.cpp lançou a compilação b11136, que atualiza o llama-server para aceitar o tipo de conteúdo "video_url" padrão da OpenAI para entradas de vídeo. Anteriormente, o servidor aceitava apenas um tipo não padrão "input_video" e rejeitava URIs de dados, causando problemas de compatibilidade com clientes conformes à OpenAI.
- Aceita "video_url" como alias para "input_video" na API de conclusões de chat.
- Lê objetos de mídia a partir de qualquer chave para garantir compatibilidade retroativa.
- Permite URIs data: para conteúdo de vídeo (data:video/*), espelhando o suporte existente para imagens.
- Fornece binários para macOS, Linux, Windows, Android e openEuler em backends de CPU, GPU e NPU.
Esta alteração permite que clientes compatíveis com a OpenAI enviem dados de vídeo para o llama-server sem encontrar erros de tipo de conteúdo não suportado.