Metaは、ローカルAIエージェントワーク用に設計された120K+のコンテキストウィンドウを持つ30Bのパラメータを持つ密集モデル「Muse Glimmer」をリリースしました。NVIDIAのエッジ、デスクトップ、ワークステーションプラットフォームで実行するように最適化されており、単一のGPUで20Kトークン/秒の処理速度を実現します。
- モデルサイズ:30Bパラメータ、密集アーキテクチャ。
- コンテキストウィンドウ:120K+トークン。
- パフォーマンス:単一GPUで20Kトークン/秒。
- 対象ハードウェア:NVIDIAのエッジ、デスクトップ、ワークステーションAIプラットフォーム。
このリリースにより、常時稼働するエージェントがクラウドインフラストラクチャに依存することなく、データをローカルで処理し、複雑なワークフローを実行できるようになります。