ZaiはGLM-5.3-Flashを発表しました。これはGLM-5シリーズ初のネイティブマルチモーダルモデルです。長いコンテキストのサービングコストを削減しつつ、正確な能力を維持するために、スパースと線形の注意力を組み合わせたハイブリッドアーキテクチャを採用しています。

  • 総パラメータ数は320Bで、アクティブなパラメータは18Bのみ。
  • ベンチマークにおいてGLM-5.2を上回り、価格は1/10。
  • コーディングおよびエージェントベンチマークではClaude Opus 4.8に迫るパフォーマンス。
  • スケーリング効率の向上のためにManifold-Constrained Hyper-Connections (mHC)を使用。
  • 30Tトークンのマルチモーダル事前学習コーパスでトレーニング済み。

モデルはZ.ai API Platformを通じて利用可能で、SGLang、vLLM、TokenSpeed、KTransformers、HLEでのデプロイメントをサポートしています。