Meta ha lanzado Muse Glimmer, un modelo denso de 30B con una ventana de contexto de más de 120K tokens diseñado para trabajo agéntico de IA local. Optimizado para ejecutarse en plataformas edge, de escritorio y estaciones de trabajo de NVIDIA, el modelo ofrece 20K tokens/seg en una sola GPU.

  • Tamaño del modelo: 30B parámetros, arquitectura densa.
  • Ventana de contexto: más de 120K tokens.
  • Rendimiento: 20K tokens/seg en una sola GPU.
  • Hardware objetivo: plataformas de IA edge, escritorio y estaciones de trabajo de NVIDIA.

Este lanzamiento permite que los agentes siempre activos procesen datos localmente y ejecuten flujos de trabajo complejos sin depender de la infraestructura en la nube.