Reflection ने Beam की घोषणा की है, जो कोडिंग, एजेंटिक और वैज्ञानिक कार्यों के लिए डिज़ाइन किया गया एक टेक्स्ट-मात्र मिक्सचर-ऑफ़-एक्सपर्ट्स मॉडल है जिसमें कुल 501 अरब पैरामीटर और 23 अरब सक्रिय पैरामीटर हैं। इस मॉडल को 23.8 ट्रिलियन प्रीट्रेनिंग टोकन का उपयोग करके शून्य से प्रशिक्षित किया गया है और इस महीने के अंत में इसके पूर्ण वजन Apache 2.0 लाइसेंस के तहत जारी किए जाने की योजना है।

  • Beam ने 10,000 GB300s पर स्थिर RL/OPD रन का उपयोग किया है जिसमें लगभग एक मिलियन कार्यों पर 100 मिलियन से अधिक रोलआउट शामिल हैं।
  • Reflection SWE-bench Verified पर 80.9 स्कोर का दावा करता है और GLM 5.2 की तुलना में तीन से चार गुना अधिक इनफरेंस दक्षता की रिपोर्ट करता है।
  • प्रशिक्षण डेटा में सैकड़ों मिलियन PDFs को प्रोसेस करने वाला एक OCR पाइपलाइन शामिल था, जिसमें प्रीट्रेनिंग और RL दोनों में लगभग चार सप्ताह लगे।
  • स्वतंत्र विश्लेषण सुझाव देता है कि Beam अपनी बुद्धिमत्ता स्तर के लिए सबसे अधिक टोकन-दक्ष ओपन मॉडलों में से एक है, हालांकि यह कुछ चीनी प्रतिस्पर्धियों जैसे DeepSeek V4.1 Flash पर कुछ बेंचमार्क्स में पीछे रह जाता है।

यह रिलीज़ Reflection के एक कार्यात्मक नियोलैब के रूप में आगमन का प्रतीक है और अमेरिकी-प्रशिक्षित ओपन मॉडल बाजार में अधिक विकल्प प्रदान करती है।