Проект llama.cpp выпустил сборку b11136, которая обновляет llama-server для приёма типа контента "video_url" по стандарту OpenAI для видеовходов. Ранее сервер принимал только нестандартный тип "input_video" и отклонял data URI, что вызывало проблемы совместимости с клиентами, соответствующими спецификации OpenAI.

  • Принимает "video_url" как псевдоним для "input_video" в API чат-завершений.
  • Считывает медиаобъекты из любого ключа для обеспечения обратной совместимости.
  • Разрешает data: URI для видеоконтента (data:video/*), отражая существующую поддержку изображений.
  • Предоставляет бинарные файлы для macOS, Linux, Windows, Android и openEuler для CPU, GPU и NPU бэкендов.

Это изменение позволяет клиентам, совместимым с OpenAI, успешно отправлять видеоданные в llama-server без ошибок неподдерживаемого типа контента.