Nvidia atinge nível de ouro na IOI e na IMO com ajustes do Nemotron 3
Modelos especializados superaram marcas de pontuação máxima em olimpíadas de programação e matemática sem recorrer a provadores formais externos.
Por que importa. O trabalho mostra que modelos de pesos abertos podem alcançar a fronteira de raciocínio complexo combinando ajuste fino direcionado e ciclos de inferência com verificação, sem criar arquiteturas do zero.
A Nvidia publicou resultados em que variações da família Nemotron 3 atingiram desempenho equivalente a medalha de ouro na Olimpíada Internacional de Informática (IOI 2026) e na Olimpíada Internacional de Matemática (IMO 2026). Os experimentos foram detalhados pela equipe da companhia no blog do Hugging Face nesta quarta-feira (7).
Na IOI 2026, o modelo Nemotron-3-Ultra-CC alcançou 535,4 pontos de um total de 600, superando a nota de corte para medalha de ouro (361,12) e a melhor pontuação humana registrada (498,27). A avaliação ocorreu em uma simulação não oficial, mas sujeita às mesmas regras de tempo, limite de envios e ausência de acesso à internet aplicadas aos competidores presenciais.
Código e provas matemáticas em linguagem natural
Para a competição de código, a equipe curou 22 mil problemas e empregou a técnica GenCorrect, um ciclo de inferência que gera, avalia e refina respostas. O Nemotron-3-Ultra-CC tem 550 bilhões de parâmetros totais, dos quais 55 bilhões são ativados por inferência, e passou por ajuste fino supervisionado (SFT).
Na IMO 2026, a abordagem combinou versões do Nemotron 3 Ultra treinadas com SFT e aprendizado por reforço (RL). As provas geradas inteiramente em linguagem natural, sem uso de ferramentas externas ou provadores formais, foram corrigidas por avaliadores oficiais da IMO e somaram 30 de 42 pontos possíveis, acima do piso de 29 pontos para o ouro.
Receita combinada de treino e inferência
Segundo a Nvidia, o diferencial não esteve apenas no tamanho do modelo base, mas no alinhamento conjunto de dados sintéticos de raciocínio com ciclos de checagem na etapa de inferência. A empresa liberou no Hugging Face e no repositório NeMo-Skills os checkpoints especializados, os conjuntos de treino e o benchmark Nemotron-IMO-Bench, com 200 problemas avançados.
Fontes
- Hugging Face: One Model Family, Two Gold-Level Results: Fine-Tuning Nemotron for IOI and IMO
Reportagem produzida pela redação do Flipters com apoio de inteligência artificial, a partir das fontes acima. Como trabalhamos.
