Reflection AI telah memperkenalkan Beam, model Sparse Mixture-of-Experts (MoE) bobot terbukanya yang pertama, dirancang untuk beban kerja pemrograman, penalaran, dan agen. Model ini memiliki total 501B parameter dengan hanya 23B parameter aktif per token, bertujuan bersaing dengan model terbuka yang lebih besar sambil menggunakan komputasi inferensi secara signifikan lebih sedikit.
- Beam dilatih awal pada 23,8 triliun token menggunakan 6.144 GPU NVIDIA GB300 dalam waktu kurang dari empat minggu, dengan dataset terkurasi yang mempertahankan sampel berkualitas tinggi yang biasanya akan dibuang oleh filter konvensional.
- Pembelajaran penguatan memanfaatkan 10.5K GPU NVIDIA GB300 selama empat minggu, menghasilkan lebih dari 100 juta rollouts di hampir satu juta lingkungan pemrograman dan agen.
- Model ini mencapai skor 80,9 pada SWE-bench Verified dan 80,1 pada Terminal Bench v2.1, mengungguli Nemotron 3 Ultra pada yang pertama sambil tetap mendekati GLM 5.2 pada yang kedua.
- Beam menyertakan parameter upaya penalaran yang dapat dikontrol, memungkinkan pengguna menyesuaikan panjang dan kompleksitas jawaban berdasarkan kesulitan tugas dan anggaran komputasi.
- Bobot dijadwalkan untuk dirilis di bawah lisensi Apache 2.0 pada akhir Oktober 2026, dengan akses awal saat ini tersedia melalui daftar tunggu di platform Reflection.
Reflection memosisikan Beam sebagai kemajuan batas bobot terbuka Barat dengan menawarkan efisiensi pada waktu inferensi dibandingkan pesaing seperti Kimi K3 dan GLM 5.2.