Pular para o conteúdo
NovidadesIA

Infraestrutura e MLOps

Nvidia leva família Nemotron a nível de ouro na IOI e na IMO de 2026

Pesquisadores adaptaram o Nemotron 3 com pós-treino e ciclos de inferência para bater marcas humanas em código e matemática.

Edição: Anderson Gomes
· 3 min de leitura

Nvidia leva família Nemotron a nível de ouro na IOI e na IMO de 2026
Imagem: Reprodução · HuggingFace · reprodução · licença não declarada

Pesquisadores da Nvidia apresentaram em 7 de outubro de 2026 dois sistemas baseados no modelo Nemotron 3 que atingiram desempenho de medalha de ouro nas olimpíadas internacionais de informática e de matemática. Na IOI 2026, a versão para código marcou 535,4 de 600 pontos e superou a melhor pontuação humana da competição, de 498,27. Na IMO 2026, o arranjo para matemática somou 30 de 42 pontos e bateu a nota de corte dourada de 29 com demonstrações escritas em linguagem natural. A receita atende equipes de engenharia ao provar que especializar uma fundação com ciclos de conferência substitui a criação de modelos novos do zero.

Para a disputa de programação, Aleksander Ficek, Igor Gitman, Sean Narenthiran, Mehrzad Samadi e Somshubra Majumdar curaram 22 mil problemas e geraram trilhas sintéticas de raciocínio. A equipe treinou duas variações: o Nemotron-3-Nano-CC, com 30 bilhões de parâmetros totais e 3 bilhões ativos, e o Nemotron-3-Ultra-CC, com 550 bilhões totais e 55 bilhões ativos. O Nano recebeu ajuste supervisionado (SFT) e aprendizado por reforço (RL). O Ultra-CC passou apenas por SFT. A escala reduziu o tempo de treino no modelo maior. Uma época de SFT no Ultra superou o Nano completo em testes da IOI, do ICPC e do LiveCodeBench Pro.

Código superou marca humana em teste sem árbitro oficial

Nos experimentos com a prova da IOI 2025, o Nano começou com 130 pontos na base pura, subiu para 280 após SFT e bateu 291 após RL. O salto veio com o GenCorrect, rotina de teste que gera, avalia e refina respostas em laço contínuo: a pontuação saltou para 468 pontos e cruzou o corte de ouro de 438,3. O Ultra-CC alcançou 502 pontos com esse mesmo mecanismo de inferência. O ganho prático nasceu da correção em tempo de execução.

Na IOI 2026, o Nemotron-3-Ultra-CC marcou 535,4 pontos sob as mesmas restrições de tempo, rede e submissões aplicadas aos estudantes. Mas a própria Nvidia fez uma ressalva direta sobre a marca. O teste ocorreu como medição prospectiva independente, sem supervisão dos organizadores e fora do quadro oficial da IOI. Nenhum competidor humano perdeu medalha para a máquina.

Provas matemáticas dispensaram provador formal e internet

Para a IMO 2026, o desafio exigia demonstrações rigorosas em texto comum, sem compilador para validar o código. A equipe preparou dois pontos de checagem do Nemotron 3 Ultra: um com SFT e outro com RL. A base de SFT reuniu 414.890 exemplos filtrados em 15.818 problemas de prova matemática, ensinando o modelo a construir argumentos, apontar lacunas, responder a críticas e checar se o raciocínio estava completo. O treino de RL usou 9.597 problemas situados perto da fronteira de capacidade da rede. O sistema aprendeu a criticar os próprios passos.

O arranjo final colocou o Nemotron 3 Ultra geral para trabalhar ao lado dos dois pontos especializados. Os modelos geraram rascunhos de provas, deram notas, apontaram falhas e refinaram as versões promissoras antes de uma etapa de alta computação escolher o texto final. A estrutura rodou sem provadores formais externos, ferramentas de apoio ou acesso à rede. Avaliadores oficiais da IMO corrigiram as demonstrações submetidas e deram nota máxima a quatro dos seis problemas propostos. A Nvidia não liberou pesos nem rotinas desses especialistas para acesso público.

  • HuggingFace
  • Infraestrutura e MLOps

Fonte: Comunicado oficial · Como produzimos as matérias