ZaiはGLM-5.3-Flashを発表しました。これはGLM-5シリーズ初のネイティブマルチモーダルモデルです。長いコンテキストのサービングコストを削減しつつ、正確な能力を維持するために、スパースと線形の注意力を組み合わせたハイブリッドアーキテクチャを採用しています。
- 総パラメータ数は320Bで、アクティブなパラメータは18Bのみ。
- ベンチマークにおいてGLM-5.2を上回り、価格は1/10。
- コーディングおよびエージェントベンチマークではClaude Opus 4.8に迫るパフォーマンス。
- スケーリング効率の向上のためにManifold-Constrained Hyper-Connections (mHC)を使用。
- 30Tトークンのマルチモーダル事前学習コーパスでトレーニング済み。
モデルはZ.ai API Platformを通じて利用可能で、SGLang、vLLM、TokenSpeed、KTransformers、HLEでのデプロイメントをサポートしています。