Reflection lança o Beam, modelo aberto de 501 bilhões de parâmetros
Sistema ativa 23 bilhões de parâmetros por token e promete igualar rivais chineses gastando até quatro vezes menos processamento.
Edição: Anderson Gomes
· 3 min de leitura

A startup Reflection anunciou em 6 de outubro de 2026 o Beam, seu primeiro modelo de inteligência artificial com pesos abertos voltado para programação e raciocínio lógico. O sistema mistura especialistas e ativa apenas 23 bilhões dos seus 501 bilhões de parâmetros por token gerado. A empresa afirma que a arquitetura empata em testes com o GLM 5.2 consumindo de três a quatro vezes menos capacidade computacional. O lançamento mira empresas que automatizam fluxo de trabalho com agentes de software, mas precisam conter gastos de infraestrutura.
Menos poder computacional na disputa com modelos chineses
O Beam disputa espaço diretamente com modelos abertos desenvolvidos na China, como as famílias Deepseek e Qwen. Em benchmarks de programação e tarefas de agente, o modelo encosta no Qwen3.8-Max, que possui porte muito maior. A própria Reflection admite que sistemas como o Kimi K3 ainda superam o Beam em desempenho bruto. No teste Terminal Bench v2.1, o Beam atingiu 80,1 pontos, enquanto o Qwen 3.8 Max marcou 90,6 e o Kimi K3 alcançou 88,3. A startup afirma que já treina um sucessor para fechar essa distância técnica.
Para sustentar o aprendizado, a Reflection colocou 10.500 placas Nvidia GB300 para rodar por quatro semanas em uma fase pesada de aprendizado por reforço. A equipe afirma que as pontuações continuaram subindo sem estabilizar mesmo após 80 milhões de tentativas executadas. O usuário ganha controle direto sobre o tempo de resposta por meio de um parâmetro ajustável no sistema. Esse controle permite escolher entre respostas rápidas e baratas ou reflexões mais longas para resolver problemas complexos. O modelo processa apenas texto, embora a empresa afirme que ele lide com outros formatos caso alguém converta os arquivos em texto antes do envio.
Pesos sob Apache 2.0 chegam até o fim do mês
A Reflection preparou um segundo modelo focado em alinhamento e regras de segurança para fundir com a rede principal. A empresa estabeleceu padrões que obrigam o sistema a admitir incerteza quando falta dado factual e a recusar pedidos proibidos. A equipe pretende publicar um relatório técnico detalhado e liberar os métodos de avaliação que criou para medir essas barreiras. No momento, apenas usuários selecionados testam uma versão prévia do sistema enquanto a startup conclui as checagens finais. A liberação pública dos pesos sob licença Apache 2.0 e da documentação para desenvolvedores ocorre até o fim de outubro de 2026.
Ex-pesquisadores da Google Deepmind fundaram a Reflection em 2024. Misha Laskin liderou modelagem de recompensas no Gemini e Ioannis Antonoglou ajudou a construir o AlphaGo. A startup estreou no mercado em março de 2025 com 130 milhões de dólares em investimento inicial para perseguir superinteligência por meio de automação de código. Durante a fase de treino com tarefas de engenharia e terminal, os criadores relataram comportamentos inesperados do modelo, como navegar na web sem treino prévio para isso. Em demonstrações divulgadas pela empresa, o Beam alimentou um mapa em tempo real do metrô de Nova York, executou um jogo em três dimensões e montou um caderno de ajuste fino para outro modelo.
- The Decoder
- Modelos e LLMs
Qwen3.8 converge 18 pontos com GPT-5.5 Pro após injeção de raciocínio
Experimento do pesquisador wsxiaoys insere tokens de pensamento da OpenAI em modelos abertos e expõe pistas de destilação.
· 3 min de leitura

Desvio no chip Apple M3 eleva taxa do Llama de 10 para 24 tokens/s
· 3 min de leitura
DeepSeek lança modelo multimodal de 552 bilhões de parâmetros com licença MIT
Arquitetura comprime cache de memória em quatro vezes e ativa só 8 bilhões de parâmetros na leitura para cortar custo de infraestrutura.
· 3 min de leitura

OpenAI lança ChatGPT para bancos com GPT-6 Astra e dados de mercado
· 3 min de leitura