Reflection AI는 코딩, 추론 및 에이전트 워크로드용으로 설계된 첫 번째 오픈 가중치 희소 Mixture-of-Experts (MoE) 모델인 Beam을 출시했습니다. 이 모델은 총 501B의 파라미터를 가지지만 토큰당 활성화되는 파라미터는 23B에 불과하며, 훨씬 적은 추론 연산량으로 더 큰 오픈 모델들과 경쟁하는 것을 목표로 합니다.

  • Beam은 4주 미만 동안 6,144대의 NVIDIA GB300 GPU를 사용하여 23.8조 개의 토큰으로 사전 학습되었으며, 기존 필터가 제거할 고품질 샘플을 유지한 선별된 데이터셋을 사용했습니다.
  • 강화 학습에는 4주 동안 10.5K대의 NVIDIA GB300 GPU가 활용되었으며, 거의 100만 개의 코딩 및 에이전트 환경에서 1억 개 이상의 롤아웃이 생성되었습니다.
  • 이 모델은 SWE-bench Verified에서 80.9점, Terminal Bench v2.1에서 80.1점을 기록하여 전자의 경우 Nemotron 3 Ultra를 능가하고 후자의 경우 GLM 5.2에 근접한 성능을 보입니다.
  • Beam은 작업의 난이도와 연산 예산에 따라 답변의 길이와 복잡성을 조정할 수 있는 제어 가능한 추론 노력 파라미터를 포함합니다.
  • 가중치는 2026년 10월 중순 Apache 2.0 라이선스 하에 출시될 예정이며, 현재 Reflection 플랫폼의 대기 목록을 통해 조기 접근이 가능합니다.

Reflection은 Beam을 Kimi K3 및 GLM 5.2와 같은 경쟁사 대비 추론 시 효율성을 제공함으로써 서양 오픈 가중치 기술의 최전선을 발전시키는 것으로 포지셔닝합니다.