A Meta lançou o Muse Glimmer, um modelo multimodal com 30 bilhões de parâmetros, destilado do Muse Spark e ajustado para fluxos de trabalho de agentes locais sempre ativos. O modelo está disponível sob a licença Apache 2.0 e roda em uma única GPU de consumo ou Mac sem chamadas de rede.

  • Os pesos são comprimidos para precisão aproximada de 4 bits, permitindo que o modelo caiba em 24 GB de VRAM com apenas 1,0% de degradação de precisão.
  • O rascunho de difusão em blocos DFlash prevê 16 tokens por passagem, proporcionando um aumento de velocidade de 3,1x em uma RTX 5090 em comparação com a decodificação padrão.
  • O Muse Glimmer supera o Gemma4-31B e o Qwen3.6-27B em benchmarks incluindo MCP Atlas (75,5), DeepSearch QA (74,6) e SWE-Bench Pro (51,2).
  • O modelo fica atrás do Qwen3.6-27B no OSWorld-Verified e TerminalBench 2.1, mas mantém desempenho sólido em tarefas de orquestração agêntica e raciocínio.

Este lançamento permite operação offline e auto-hospedada para empresas reguladas e desenvolvedores que exigem residência de dados e baixa latência sem cobrança por token.