Metaは、ローカルAIエージェントワーク用に設計された120K+のコンテキストウィンドウを持つ30Bのパラメータを持つ密集モデル「Muse Glimmer」をリリースしました。NVIDIAのエッジ、デスクトップ、ワークステーションプラットフォームで実行するように最適化されており、単一のGPUで20Kトークン/秒の処理速度を実現します。

  • モデルサイズ:30Bパラメータ、密集アーキテクチャ。
  • コンテキストウィンドウ:120K+トークン。
  • パフォーマンス:単一GPUで20Kトークン/秒。
  • 対象ハードウェア:NVIDIAのエッジ、デスクトップ、ワークステーションAIプラットフォーム。

このリリースにより、常時稼働するエージェントがクラウドインフラストラクチャに依存することなく、データをローカルで処理し、複雑なワークフローを実行できるようになります。