Meta a lancé Muse Glimmer, un modèle dense de 30B avec une fenêtre de contexte de plus de 120K tokens conçu pour le travail agentique d'IA local. Optimisé pour fonctionner sur les plateformes edge, de bureau et stations de travail NVIDIA, le modèle offre 20K tokens/sec sur un seul GPU.
- Taille du modèle : 30B paramètres, architecture dense.
- Fenêtre de contexte : plus de 120K tokens.
- Performance : 20K tokens/sec sur un seul GPU.
- Matériel cible : plateformes IA edge, de bureau et stations de travail NVIDIA.
Cette publication permet aux agents toujours actifs de traiter les données localement et d'exécuter des flux de travail complexes sans dépendre de l'infrastructure cloud.