Alibaba Cloudは、実世界の生産性タスク向けに設計されたネイティブな多モーダルエージェントモデルであるQwen3.8-Omni-Flashを発表しました。このモデルは、以前のオムニモデルと比較して、多モーダルな理解と推論を大幅に改善します。

このモデルはQwen3.8-Nextからスパースミキシング・オブ・エクスパートズ(sparse mixture-of-experts)アーキテクチャを受け継ぎ、長期の文脈における多モーダル推論や長期計画をサポートするためにコンテキストウィンドウを100万トークンに拡張しました。また、ネイティブな多モーダル共同学習戦略を採用しており、テキスト領域での強力な能力を維持しつつ、オーディオおよびビデオタスクへのエージェント機能の移行を促進します。

デプロイメントをサポートするため、チームは多モーダル生産性用のQwen-MM-Pluginsと、応答性の高いリアルタイムの多モーダルエージェントを構築するためのQwen-Live-Harnessをリリースしました。これらのツールにより、動画編集、長文翻訳、音楽条件付き生成などのアプリケーション向けに、プロダクションワークフローへの統合が可能になります。