Meta telah merilis Muse Glimmer, model padat 30B dengan jendela konteks lebih dari 120K token yang dirancang untuk pekerjaan AI agentic lokal. Dioptimalkan untuk berjalan di platform edge, desktop, dan workstation NVIDIA, model ini menghasilkan 20K token/detik pada satu GPU.
- Ukuran model: 30B parameter, arsitektur padat.
- Jendela konteks: lebih dari 120K token.
- Kinerja: 20K token/detik pada satu GPU.
- Perangkat keras target: platform AI edge, desktop, dan workstation NVIDIA.
Rilis ini memungkinkan agen yang selalu aktif memproses data secara lokal dan menjalankan alur kerja kompleks tanpa bergantung pada infrastruktur cloud.