Modelos

Nvidia atinge nível de ouro na IOI e na IMO com ajustes do Nemotron 3

Modelos especializados superaram marcas de pontuação máxima em olimpíadas de programação e matemática sem recorrer a provadores formais externos.

Capa ilustrativa da editoria Modelos

Por que importa. O trabalho mostra que modelos de pesos abertos podem alcançar a fronteira de raciocínio complexo combinando ajuste fino direcionado e ciclos de inferência com verificação, sem criar arquiteturas do zero.

A Nvidia publicou resultados em que variações da família Nemotron 3 atingiram desempenho equivalente a medalha de ouro na Olimpíada Internacional de Informática (IOI 2026) e na Olimpíada Internacional de Matemática (IMO 2026). Os experimentos foram detalhados pela equipe da companhia no blog do Hugging Face nesta quarta-feira (7).

Na IOI 2026, o modelo Nemotron-3-Ultra-CC alcançou 535,4 pontos de um total de 600, superando a nota de corte para medalha de ouro (361,12) e a melhor pontuação humana registrada (498,27). A avaliação ocorreu em uma simulação não oficial, mas sujeita às mesmas regras de tempo, limite de envios e ausência de acesso à internet aplicadas aos competidores presenciais.

Código e provas matemáticas em linguagem natural

Para a competição de código, a equipe curou 22 mil problemas e empregou a técnica GenCorrect, um ciclo de inferência que gera, avalia e refina respostas. O Nemotron-3-Ultra-CC tem 550 bilhões de parâmetros totais, dos quais 55 bilhões são ativados por inferência, e passou por ajuste fino supervisionado (SFT).

Na IMO 2026, a abordagem combinou versões do Nemotron 3 Ultra treinadas com SFT e aprendizado por reforço (RL). As provas geradas inteiramente em linguagem natural, sem uso de ferramentas externas ou provadores formais, foram corrigidas por avaliadores oficiais da IMO e somaram 30 de 42 pontos possíveis, acima do piso de 29 pontos para o ouro.

Receita combinada de treino e inferência

Segundo a Nvidia, o diferencial não esteve apenas no tamanho do modelo base, mas no alinhamento conjunto de dados sintéticos de raciocínio com ciclos de checagem na etapa de inferência. A empresa liberou no Hugging Face e no repositório NeMo-Skills os checkpoints especializados, os conjuntos de treino e o benchmark Nemotron-IMO-Bench, com 200 problemas avançados.

Fontes

  • Hugging Face: One Model Family, Two Gold-Level Results: Fine-Tuning Nemotron for IOI and IMO

Reportagem produzida pela redação do Flipters com apoio de inteligência artificial, a partir das fontes acima. Como trabalhamos.

WhatsAppLinkedInX
Voltar para a edição

Mais em Modelos

Ver todas

Quem constrói lê

Receba o Flipters no seu e-mail. A newsletter de IA para quem está tirando produto do papel.