Meta выпустила Muse Glimmer, плотную модель с 30B параметров и контекстным окном более 120K токенов, предназначенную для локальной работы агентов ИИ. Модель оптимизирована для работы на периферийных устройствах, настольных компьютерах и рабочих станциях NVIDIA, обеспечивая скорость 20K токенов/сек на одной GPU.
- Размер модели: 30B параметров, плотная архитектура.
- Контекстное окно: более 120K токенов.
- Производительность: 20K токенов/сек на одной GPU.
- Целевое оборудование: периферийные устройства, настольные ПК и рабочие станции NVIDIA для ИИ.
Это обновление позволяет всегда активным агентам обрабатывать данные локально и выполнять сложные рабочие процессы без reliance на облачную инфраструктуру.