Matemáticos debatem boicote à OpenAI após estudo apontar falhas em provas de IA
Pesquisadores apontam divergências entre explicações e código formal da OpenAI, enquanto grupos acadêmicos propõem interromper o uso dos modelos da empresa.
Por que importa. Para quem desenvolve com LLMs em tarefas analíticas complexas, o caso reforça o risco de confiar em saídas sintéticas sem checagem humana e o custo invisível de auditar códigos formalizados por IA.
A publicação de centenas de supostas soluções matemáticas pela OpenAI ampliou a tensão com a comunidade acadêmica. Pesquisadores passaram a discutir um boicote aos serviços da empresa, enquanto uma nova análise técnica revelou divergências nas demonstrações geradas pelos modelos internos do laboratório.
Divergências no código e diretrizes ignoradas
Segundo o TechCrunch, um estudo conduzido por matemáticos da Universidade de Cambridge e do King's College de Londres documentou ao menos duas discrepâncias entre o texto em linguagem natural e o código gerado na linguagem formal Lean, em uma solução da OpenAI ligada às equações de Navier-Stokes. A falha expõe o perigo de presumir que modelos consigam autoformalizar provas sem supervisão humana rigorosa.
A OpenAI havia afirmado que consultou o grupo de aconselhamento AGMAI, sediado no Instituto de Estudos Avançados de Princeton, para evitar polêmicas. Contudo, o laboratório descumpriu a principal recomendação da entidade, que pedia a interrupção de testes de problemas avançados em modelos proprietários. Das 719 publicações disponibilizadas pela empresa, apenas dez continham o raciocínio detalhado do modelo e 42% não haviam passado por formalização matemática.
Sobrecarga de revisão e apelos por boicote
De acordo com apuração do The Decoder, o grupo AHM classificou o lançamento em massa como uma demonstração de poder e não de rigor acadêmico. Pesquisadores ouvidos na discussão argumentam que a comunidade científica foi sobrecarregada com o trabalho não remunerado de auditar documentos densos e confusos produzidos por máquinas.
O medalhista Fields Terence Tao alertou que a resolução em larga escala por usuários sem domínio da área contamina o avanço da matemática, esvaziando seminários e colaborações em torno de novos conceitos. O teórico Scott Aaronson relatou que sua esposa, a pesquisadora Dana Moshkovitz, analisou a prova da conjectura Unique Games e a considerou bizarra e ilegível sem apoio de IA. Aaronson também afirmou que a OpenAI testou cerca de 8.000 problemas matemáticos com taxa de sucesso em torno de 5%, deixando áreas sensíveis como criptografia fora da divulgação pública.
Fontes
- TechCrunch: OpenAI’s math solutions aren’t meeting the field’s standards yet
- The Decoder: Some mathematicians call for OpenAI boycott after AI-generated proofs flood their field
Reportagem produzida pela redação do Flipters com apoio de inteligência artificial, a partir das fontes acima. Como trabalhamos.
