Pular para o conteúdo
NovidadesIA

Modelos e LLMs

Reflection lança o Beam, modelo aberto de 501 bilhões de parâmetros

Sistema ativa 23 bilhões de parâmetros por token e promete igualar rivais chineses gastando até quatro vezes menos processamento.

Edição: Anderson Gomes
· 3 min de leitura

Imagem: Reprodução · The Decoder · licença livre · licença mit

A startup Reflection anunciou em 6 de outubro de 2026 o Beam, seu primeiro modelo de inteligência artificial com pesos abertos voltado para programação e raciocínio lógico. O sistema mistura especialistas e ativa apenas 23 bilhões dos seus 501 bilhões de parâmetros por token gerado. A empresa afirma que a arquitetura empata em testes com o GLM 5.2 consumindo de três a quatro vezes menos capacidade computacional. O lançamento mira empresas que automatizam fluxo de trabalho com agentes de software, mas precisam conter gastos de infraestrutura.

Menos poder computacional na disputa com modelos chineses

O Beam disputa espaço diretamente com modelos abertos desenvolvidos na China, como as famílias Deepseek e Qwen. Em benchmarks de programação e tarefas de agente, o modelo encosta no Qwen3.8-Max, que possui porte muito maior. A própria Reflection admite que sistemas como o Kimi K3 ainda superam o Beam em desempenho bruto. No teste Terminal Bench v2.1, o Beam atingiu 80,1 pontos, enquanto o Qwen 3.8 Max marcou 90,6 e o Kimi K3 alcançou 88,3. A startup afirma que já treina um sucessor para fechar essa distância técnica.

Para sustentar o aprendizado, a Reflection colocou 10.500 placas Nvidia GB300 para rodar por quatro semanas em uma fase pesada de aprendizado por reforço. A equipe afirma que as pontuações continuaram subindo sem estabilizar mesmo após 80 milhões de tentativas executadas. O usuário ganha controle direto sobre o tempo de resposta por meio de um parâmetro ajustável no sistema. Esse controle permite escolher entre respostas rápidas e baratas ou reflexões mais longas para resolver problemas complexos. O modelo processa apenas texto, embora a empresa afirme que ele lide com outros formatos caso alguém converta os arquivos em texto antes do envio.

Pesos sob Apache 2.0 chegam até o fim do mês

A Reflection preparou um segundo modelo focado em alinhamento e regras de segurança para fundir com a rede principal. A empresa estabeleceu padrões que obrigam o sistema a admitir incerteza quando falta dado factual e a recusar pedidos proibidos. A equipe pretende publicar um relatório técnico detalhado e liberar os métodos de avaliação que criou para medir essas barreiras. No momento, apenas usuários selecionados testam uma versão prévia do sistema enquanto a startup conclui as checagens finais. A liberação pública dos pesos sob licença Apache 2.0 e da documentação para desenvolvedores ocorre até o fim de outubro de 2026.

Ex-pesquisadores da Google Deepmind fundaram a Reflection em 2024. Misha Laskin liderou modelagem de recompensas no Gemini e Ioannis Antonoglou ajudou a construir o AlphaGo. A startup estreou no mercado em março de 2025 com 130 milhões de dólares em investimento inicial para perseguir superinteligência por meio de automação de código. Durante a fase de treino com tarefas de engenharia e terminal, os criadores relataram comportamentos inesperados do modelo, como navegar na web sem treino prévio para isso. Em demonstrações divulgadas pela empresa, o Beam alimentou um mapa em tempo real do metrô de Nova York, executou um jogo em três dimensões e montou um caderno de ajuste fino para outro modelo.

  • The Decoder
  • Modelos e LLMs

Fonte: Comunicado oficial · Como produzimos as matérias