OpenSenseNovaは、専門家を単一の統合アーキテクチャに集約した画像生成モデルであるSenseNova U1.5-Liteのフルバージョンをリリースしました。今回のリリースでは、タスク指向強化学習を導入し、テキストレンダリング、インフォグラフィックス、美的品質、編集用にトレーニングされたモデルをマージするためにオープンパラメータ蒸留(OPD)を活用しています。

  • ベンチマークによると、フルバージョンはQwen-Image-Bench(60.18)、ImgEdit(4.59)、GEdit-Bench-EN(8.26)でプレビュー版を上回っています。
  • モデルは安定したグローバル構造と正確なローカル編集を備えたネイティブ4K生成をサポートしています。
  • 後期トレーニングには、指示遵守、視覚的品質、好み整列、編集忠実度の目標が含まれます。
  • 理解タスクからの表現が生成に転移し、複雑な制約や空間関係の処理が向上します。

このアプローチにより、ユーザーは推論時に手動での専門家選択やルーティングメカニズムなしで専門的な機能にアクセスできます。