रिफ्लेक्शन एआई ने बीम का परिचय दिया, कोडिंग, तर्क और एजेंटिक कार्यभारों के लिए डिज़ाइन किया गया उनका पहला ओपन-वेट स्पार्स मिक्सचर-ऑफ़-एक्सपर्ट्स (MoE) मॉडल। इस मॉडल में कुल 501B पैरामीटर हैं, लेकिन प्रति टोकन केवल 23B सक्रिय हैं, जिसका उद्देश्य कम इनफरेंस कंप्यूट का उपयोग करते हुए बड़े ओपन मॉडल्स से प्रतिस्पर्धा करना है।

  • बीम का प्रीट्रेनिंग 4 सप्ताह से भी कम समय में 6,144 NVIDIA GB300 GPUs पर 23.8 ट्रिलियन टोकन का उपयोग करके किया गया, जिसमें एक चुनिंदा डेटासेट शामिल था जिसने उन उच्च-गुणवत्ता वाले नमूनों को बनाए रखा जो पारंपरिक फ़िल्टर छोड़ देते।
  • प्रबलन सीखने (Reinforcement learning) में 4 सप्तात के लिए 10.5K NVIDIA GB300 GPUs का उपयोग किया गया, जिसके परिणामस्वरूप लगभग एक मिलियन कोडिंग और एजेंटिक वातावरणों में 100 मिलियन से अधिक रोलआउट उत्पन्न हुए।
  • मॉडल ने SWE-bench Verified पर 80.9 और Terminal Bench v2.1 पर 80.1 अंक हासिल किए, जिसमें पहले वाले में Nemotron 3 Ultra को हराया गया जबकि दूसरे में GLM 5.2 के करीब रहा।
  • बीम में एक नियंत्रणीय तर्क प्रयास पैरामीटर शामिल है, जो उपयोगकर्ताओं को कार्य की कठिनाई और कंप्यूट बजट के आधार पर उत्तर की लंबाई और जटिलता को समायोजित करने की अनुमति देता है।
  • वजन अक्टूबर 2026 में बाद में Apache 2.0 लाइसेंस के तहत जारी किए जाने की योजना है, जबकि रिफ्लेक्शन प्लेटफ़ॉर्म पर वेटलिस्ट के माध्यम से अभी प्रारंभिक पहुंच उपलब्ध है।

रिफ्लेक्शन बीम को पश्चिमी ओपन-वेट सीमा को आगे बढ़ाने के रूप में स्थापित करता है, जो Kimi K3 और GLM 5.2 जैसे प्रतिस्पर्धियों की तुलना में इनफरेंस समय पर दक्षता प्रदान करके।