Pesquisa

Matemáticos debatem boicote à OpenAI após estudo apontar falhas em provas de IA

Pesquisadores apontam divergências entre explicações e código formal da OpenAI, enquanto grupos acadêmicos propõem interromper o uso dos modelos da empresa.

Capa ilustrativa da editoria Pesquisa

Por que importa. Para quem desenvolve com LLMs em tarefas analíticas complexas, o caso reforça o risco de confiar em saídas sintéticas sem checagem humana e o custo invisível de auditar códigos formalizados por IA.

A publicação de centenas de supostas soluções matemáticas pela OpenAI ampliou a tensão com a comunidade acadêmica. Pesquisadores passaram a discutir um boicote aos serviços da empresa, enquanto uma nova análise técnica revelou divergências nas demonstrações geradas pelos modelos internos do laboratório.

Divergências no código e diretrizes ignoradas

Segundo o TechCrunch, um estudo conduzido por matemáticos da Universidade de Cambridge e do King's College de Londres documentou ao menos duas discrepâncias entre o texto em linguagem natural e o código gerado na linguagem formal Lean, em uma solução da OpenAI ligada às equações de Navier-Stokes. A falha expõe o perigo de presumir que modelos consigam autoformalizar provas sem supervisão humana rigorosa.

A OpenAI havia afirmado que consultou o grupo de aconselhamento AGMAI, sediado no Instituto de Estudos Avançados de Princeton, para evitar polêmicas. Contudo, o laboratório descumpriu a principal recomendação da entidade, que pedia a interrupção de testes de problemas avançados em modelos proprietários. Das 719 publicações disponibilizadas pela empresa, apenas dez continham o raciocínio detalhado do modelo e 42% não haviam passado por formalização matemática.

Sobrecarga de revisão e apelos por boicote

De acordo com apuração do The Decoder, o grupo AHM classificou o lançamento em massa como uma demonstração de poder e não de rigor acadêmico. Pesquisadores ouvidos na discussão argumentam que a comunidade científica foi sobrecarregada com o trabalho não remunerado de auditar documentos densos e confusos produzidos por máquinas.

O medalhista Fields Terence Tao alertou que a resolução em larga escala por usuários sem domínio da área contamina o avanço da matemática, esvaziando seminários e colaborações em torno de novos conceitos. O teórico Scott Aaronson relatou que sua esposa, a pesquisadora Dana Moshkovitz, analisou a prova da conjectura Unique Games e a considerou bizarra e ilegível sem apoio de IA. Aaronson também afirmou que a OpenAI testou cerca de 8.000 problemas matemáticos com taxa de sucesso em torno de 5%, deixando áreas sensíveis como criptografia fora da divulgação pública.

Fontes

  • TechCrunch: OpenAI’s math solutions aren’t meeting the field’s standards yet
  • The Decoder: Some mathematicians call for OpenAI boycott after AI-generated proofs flood their field

Reportagem produzida pela redação do Flipters com apoio de inteligência artificial, a partir das fontes acima. Como trabalhamos.

WhatsAppLinkedInX
Voltar para a edição

Mais em Pesquisa

Ver todas

Quem constrói lê

Receba o Flipters no seu e-mail. A newsletter de IA para quem está tirando produto do papel.