Meta telah merilis MobileMoE, sebuah koleksi model bahasa Mixture-of-Experts (MoE) untuk perangkat seluler yang dirancang untuk mengoptimalkan trade-off kualitas-efisiensi pada perangkat seluler. Keluarga ini mencakup tiga skala model dengan parameter aktif di bawah satu miliar dan jejak bobot di bawah 3 GB dalam format INT4.
- Model-model ini memiliki 0,3B, 0,5B, dan 0,9B parameter aktif (1,3B, 2,8B, dan 5,3B total), masing-masing tersedia dalam varian Base, SFT, dan QAT.
- MobileMoE-L-Base adalah model pra-latih dengan 922M parameter aktif, 32 lapisan, dan panjang konteks 8.192 token.
- Arsitektur ini memanfaatkan 60 ahli yang dialihkan dengan routing top-k sigmoid dan satu ahli bersama, mendukung input dan output teks bahasa Inggris.
- Dirilis di bawah lisensi FAIR NC pada Agustus 2026, model-model tersebut di-hosting di Hugging Face.