A Reflection AI apresentou o Beam, seu primeiro modelo esparso Mixture-of-Experts (MoE) de pesos abertos projetado para tarefas de codificação, raciocínio e agentes. O modelo possui 501B de parâmetros totais, com apenas 23B ativos por token, visando competir com modelos abertos maiores enquanto utiliza significativamente menos poder computacional de inferência.
- O Beam foi pré-treinado em 23,8 trilhões de tokens usando 6.144 GPUs NVIDIA GB300 em menos de quatro semanas, com um conjunto de dados curado que manteve amostras de alta qualidade que filtros convencionais descartariam.
- O aprendizado por reforço utilizou 10,5 mil GPUs NVIDIA GB300 por quatro semanas, gerando mais de 100 milhões de rollouts em quase um milhão de ambientes de codificação e agentes.
- O modelo alcança 80,9 no SWE-bench Verified e 80,1 no Terminal Bench v2.1, superando o Nemotron 3 Ultra no primeiro enquanto permanece próximo ao GLM 5.2 no segundo.
- O Beam inclui um parâmetro de esforço de raciocínio controlável, permitindo que os usuários ajustem o comprimento e a complexidade da resposta com base na dificuldade da tarefa e no orçamento computacional.
- Os pesos estão programados para serem lançados sob uma licença Apache 2.0 no final de outubro de 2026, com acesso antecipado disponível atualmente por meio de lista de espera na plataforma Reflection.
A Reflection posiciona o Beam como um avanço na fronteira de pesos abertos ocidental, oferecendo eficiência no tempo de inferência em comparação com concorrentes como Kimi K3 e GLM 5.2.