A Meta lançou o Muse Glimmer, um modelo denso de 30B com uma janela de contexto de mais de 120K tokens, projetado para trabalho agêntico de IA local. Otimizado para rodar em plataformas edge, desktop e estações de trabalho da NVIDIA, o modelo oferece 20K tokens/seg em uma única GPU.
- Tamanho do modelo: 30B parâmetros, arquitetura densa.
- Janela de contexto: mais de 120K tokens.
- Desempenho: 20K tokens/seg em uma única GPU.
- Hardware alvo: plataformas de IA edge, desktop e estações de trabalho da NVIDIA.
Este lançamento permite que agentes sempre ativos processem dados localmente e executem fluxos de trabalho complexos sem depender de infraestrutura na nuvem.