구글은 Gemini API를 통해 Google AI Studio에서 전문적인 사용을 위해 모델이 프로덕션 준비가 되도록 설계된 새로운 창의적 컨트롤과 생성형 비디오 기능 세트를 선보이는 Gemini Omni 1.1 Flash를 소개했습니다.

  • 장면 확장을 통해 모델은 최대 10초의 이전 컨텍스트를 분석하여 총 길이가 40초가 될 때까지 10초 단위로 영상을 계속 생성할 수 있습니다.
  • 개발자는 키프레임 사이의 연속적인 비디오를 생성하기 위해 첫 번째와 마지막 프레임을 지정하여 부드러운 전환과 카메라 움직임을 만들 수 있습니다.
  • 360p 해상도로 비디오를 작성하는 속도는 표준 720p 해상도 대비 최대 60% 빠르며 비용은 3분의 1 수준입니다.
  • 모델은 다듬고 고품질의 결과를 얻기 위해 출력을 1080p 또는 4K 해상도로 업스케일링할 수 있습니다.
  • 멀티모달 입력을 통해 시각적 컨텍스트와 캐릭터 일관성을 유지하기 위해 최대 3초의 비디오를 참조할 수 있습니다.

Omni 1.1은 Google AI Studio와 Gemini Enterprise Agent Platform을 포함한 구글 개발자 생태계 전반에 걸쳐 롤아웃되고 있으며, Google Flow에서 Google AI Plus, Pro 및 Ultra 구독자에게 제공됩니다.