Alibaba Cloud는 이전 오미 모델에 비해 멀티모달 이해와 추론을 크게 향상시키는 실세계 생산성 작업을 위해 설계된 네이티브 멀티모달 에이전트 모델인 Qwen3.8-Omni-Flash를 소개했습니다.

이 모델은 Qwen3.8-Next에서 희소 혼합 전문가(sparse mixture-of-experts) 아키텍처를 상속받아 긴 컨텍스트 멀티모달 추론과 장기 계획을 지원하기 위해 컨텍스트 창을 100만 토큰으로 확장했습니다. 또한 텍스트 도메인 능력을 유지하면서 오디오 및 비디오 작업에 대한 에이전트 능력 이전을 촉진하는 네이티브 멀티모달 공동 학습 전략을 사용합니다.

배포를 지원하기 위해 팀은 멀티모달 생산성을 위한 Qwen-MM-Plugins와 반응형 실시간 멀티모달 에이전트를 구축하기 위한 Qwen-Live-Harness를 출시했습니다. 이러한 도구는 비디오 편집, 장문 번역, 음악 조건부 생성 등의 애플리케이션을 위한 프로덕션 워크플로우에 통합할 수 있게 합니다.