A Reflection AI lançou o Beam, seu primeiro modelo com pesos abertos, em acesso antecipado no dia 5 de outubro. O modelo está concluindo os testes de red team, e os pesos, o relatório técnico e o cartão do modelo serão disponibilizados ainda este mês.

Segundo a Reflection, os pesos são disponibilizados sob a licença Apache 2.0, junto com toda a infraestrutura necessária para executar, avaliar e ajustar o Beam.

Paridade com o GLM-5.2 usando de 3 a 4 vezes menos computação de inferência

Beam é um modelo esparso de mistura de especialistas, com 501 bilhões de parâmetros e 23 bilhões de parâmetros ativos por token. Ele foi pré-treinado com 23,8 trilhões de tokens, e seu comprimento de contexto chegou a 1 milhão de tokens durante o treinamento intermediário.

A Reflection afirma que Beam se equipara ao GLM-5.2 da Z.ai em testes de raciocínio avançado, usando “3–4× menos computação de inferência”. As alegações não foram verificadas de forma independente.

O GLM-5.2 tem cerca de 744 bilhões de parâmetros, dos quais 40 bilhões são ativos. A Reflection coloca o Kimi K3 à frente em capacidade bruta e apresenta a eficiência de inferência como vantagem do Beam.

Em comparação com o Inkling, da Thinking Machines Lab, lançado em julho, as tabelas da Reflection mostram Beam à frente em quatro benchmarks de programação com pontuações para os dois modelos.

No SWE Bench Pro v2-Hard, Beam obteve 77,2, contra 56,9 do Inkling. Inkling é multimodal, enquanto Beam é apenas de texto.

Reflection AI's Beam opens to early access, with open weights due later in October.Pontuações de Beam e Inkling no benchmark de programação, segundo o anúncio da Reflection de 5 de outubro de 2026.

10.500 GPUs Nvidia GB300 operaram durante quatro semanas de RL

A execução de RL da Reflection usou 10.500 GPUs Nvidia GB300 durante quatro semanas, gerou mais de 100 milhões de rollouts e utilizou cerca de 1,3 bilhão de sandboxes para treinamento e avaliação.

Segundo a empresa, esta é uma das maiores execuções de RL já realizadas por um laboratório aberto. De acordo com os cálculos da Reflection, o Inkling foi treinado com 30 milhões de rollouts.

A Reflection foi fundada em 2024 por Misha Laskin e Ioannis Antonoglou, ambos ex-pesquisadores do Google DeepMind. A empresa captou cerca de US$ 4,7 bilhões de investidores, entre eles Nvidia, Sequoia Capital e Lightspeed Venture Partners, mais recentemente com uma avaliação pré-investimento de US$ 25 bilhões.

Há um ano, captou US$ 2 bilhões com uma avaliação de US$ 8 bilhões, informou a Cryptopolitan. Só o contrato com a SpaceX chega a US$ 6,3 bilhões, a US$ 150 milhões por mês pela capacidade de Nvidia GB300 no Colossus 2, perto de Memphis, informou a Cryptopolitan em junho.

Beam também alimenta a proposta de “fábrica de IA” da Reflection, que permite às instituições treinar seus modelos com os próprios dados e executá-los em seus próprios recursos computacionais. O Grupo Shinsegae está testando uma versão soberana na Coreia do Sul.

“Eles são meio como foguetes”, disse Laskin sobre a trajetória de seus modelos rumo à fronteira tecnológica. “Construir um foguete grande leva tempo.”

As mentes mais brilhantes do mundo cripto já leem nossa newsletter. Quer fazer parte? Junte-se a elas.