أعلنت ريفليكشن عن Beam، وهو نموذج مزيج من الخبراء (Mixture-of-Experts) للنص فقط، يحتوي على 501 مليار معامل إجمالي و23 مليار معامل نشط، ومصمم لمهام البرمجة والوكيلية والعلمية. تم تدريب النموذج من الصفر باستخدام 23.8 تريليون رمز للتدريب المسبق، ومن المقرر إصدار الأوزان الكاملة بموجب رخصة Apache 2.0 خلال هذا الشهر.

  • يستخدم Beam تشغيلًا مستقرًا لـ RL/OPD على 10,000 جهاز GB300s مع أكثر من 100 مليون جولة عبر حوالي مليون مهمة.
  • تدعي ريفليكشن تحقيقها لنتيجة 80.9 على SWE-bench Verified، وتبلغ كفاءة الاستدلال فيها ثلاثة إلى أربعة أضعاف تلك الخاصة بـ GLM 5.2.
  • تضمنت بيانات التدريب خط أنابيب OCR يعالج مئات الملايين من ملفات PDF، حيث استغرق كل من التدريب المسبق وRL حوالي أربعة أسابيع.
  • تشير التحليلات المستقلة إلى أن Beam يعد من بين أكثر النماذج المفتوحة كفاءة في استخدام الرموز لمستوى ذكائه، رغم تأخره عن بعض النظراء الصينيين مثل DeepSeek V4.1 Flash في بعض المقاييس.

يشير هذا الإصدار إلى وصول ريفليكشن كـ neolab وظيفي، ويوفر خيارات أكثر في سوق النماذج المفتوحة المدربة في الولايات المتحدة.