OpenAI publica 719 manuscritos de matemática de modelo não lançado
OpenAI divulga 719 provas matemáticas de modelo interno, enfrentando críticas de pesquisadores sobre transparência e padrões de verificação científica.
Pontos principais
- Os 719 manuscritos estão organizados em 372 famílias, com 42% dos resultados principais formalizados em Lean.
- Cada resultado utilizou, em média, três horas de processamento do ChatGPT Pro em cerca de 4.000 problemas testados.
- O Advisory Group on Mathematics and Artificial Intelligence (AGMAI) recomendou que laboratórios suspendam testes de problemas avançados em modelos proprietários.
- Pesquisadores apontam discrepâncias entre a linguagem natural e o código Lean em problemas como as equações de Navier-Stokes.
- Apenas 10 dos manuscritos incluem o raciocínio detalhado do modelo, gerando críticas sobre a falta de transparência e compreensão humana.
A OpenAI publicou em 6 de outubro 719 manuscritos de matemática gerados por um modelo de inteligência artificial ainda não lançado. Os documentos, disponibilizados em um repositório no GitHub, abrangem 372 famílias de problemas e incluem formalizações em Lean para 42% dos resultados. Segundo a empresa, cada solução consumiu em média três horas de processamento do ChatGPT Pro, e a companhia reconhece que resultados não formalizados podem conter erros que pretende corrigir rapidamente.
A iniciativa enfrenta críticas de pesquisadores sobre a conformidade com padrões científicos. O Advisory Group on Mathematics and Artificial Intelligence (AGMAI) recomendou que laboratórios interrompam o uso de modelos proprietários para problemas matemáticos avançados, prática mantida pela OpenAI. Especialistas destacam que apenas 10 manuscritos apresentam o raciocínio do modelo e apontam discrepâncias entre a linguagem natural e o código Lean em temas complexos, como as equações de Navier-Stokes. A comunidade acadêmica argumenta que a ausência de envolvimento humano na verificação compromete a validade científica dos resultados apresentados.
Fontes primárias
Sharing AI progress in mathematics
Publicação de 6/10/2026: a OpenAI diz que está divulgando 'uma ampla gama de novos resultados matemáticos produzidos por um modelo fronteira interno', ainda não lançado. Os resultados são publicados num repositório no GitHub, com protocolos para revisão de papers e citações, e com formalizações em Lean de muitas das provas. Também publica 10 resumos do raciocínio do modelo, estimativas de compute em uso de ChatGPT Pro e estatísticas sobre o número de problemas tentados. Diz que o resultado médio usou o equivalente a cerca de três horas de ChatGPT Pro. Afirma ter consultado o Advisory Group on Mathematics and Artificial Intelligence do Institute for Advanced Study, que sustenta a escolha do GitHub como canal, e que segue explorando alternativas hospedadas pela comunidade. Anuncia financiamento de workshops, conferências e programas sobre a compreensão de resultados produzidos por IA, e diz que trabalha para lançar o modelo 'de forma responsável'.
openai/math — README (catálogo de manuscritos)
O README diz que o repositório contém manuscritos e artefatos de prova produzidos por um modelo interno da OpenAI, avaliado em problemas de pesquisa aberta. O catálogo atual tem 719 manuscritos organizados em 372 famílias (a imprensa circulou o número 722). Cerca de 42% dos resultados de topo têm formalização em Lean. A OpenAI avisa que os resultados estão em estágios diferentes de verificação e que 'alguns dos resultados não formalizados podem ter problemas', que pretende corrigir 'rapidamente'. Os resultados vêm de cerca de 4.000 problemas apresentados ao modelo; em média cada resultado consumiu três horas de ChatGPT Pro. Exceções ao procedimento padrão: trabalho sobre uma região livre de zeros da função zeta de Riemann e uma prova da Conjectura de Hodge para variedades abelianas CM. A redação da região Re(s) > 11/12 foi editada por humanos para legibilidade.
Tópicos relacionados
Cobertura da mídia
Comentários
Carregando comentários...
