Meta выпустила Muse Glimmer, плотную модель с 30B параметров и контекстным окном более 120K токенов, предназначенную для локальной работы агентов ИИ. Модель оптимизирована для работы на периферийных устройствах, настольных компьютерах и рабочих станциях NVIDIA, обеспечивая скорость 20K токенов/сек на одной GPU.

  • Размер модели: 30B параметров, плотная архитектура.
  • Контекстное окно: более 120K токенов.
  • Производительность: 20K токенов/сек на одной GPU.
  • Целевое оборудование: периферийные устройства, настольные ПК и рабочие станции NVIDIA для ИИ.

Это обновление позволяет всегда активным агентам обрабатывать данные локально и выполнять сложные рабочие процессы без reliance на облачную инфраструктуру.