OpenAI publica 722 manuscritos de matematica de um modelo interno

A OpenAI publicou no GitHub uma colecao de 722 manuscritos de matematica, organizados em 372 familias de resultados. Os textos foram produzidos por um modelo interno ainda nao lancado, depois de a empresa ampliar os testes para problemas em aberto quando as avaliacoes matematicas existentes deixaram de diferenciar os modelos.

O que aconteceu?

O repositorio openai/math reune manuscritos e artefatos de prova. A propria OpenAI descreve o material como saida de um modelo interno, nao de um produto publico. Segundo o leia-me, a maior parte dos resultados seguiu o mesmo procedimento, e um resultado medio consumiu cerca de tres horas de computacao no nivel do ChatGPT Pro com esse modelo. A empresa diz que avaliou o sistema em cerca de 4.000 problemas em aberto.

O catalogo tem 722 manuscritos de matematica em 372 familias. Uma familia agrupa um resultado principal, argumentos companheiros, consequencias ou provas alternativas. Nem tudo esta formalizado em Lean, a linguagem usada para checar provas de forma mecanica. O New Scientist, citando o catalogo, aponta que so 162 dos 722 artigos tem o resultado principal formalizado, enquanto 235 das 372 familias trazem algum codigo Lean. A OpenAI afirma que vai atualizar o repositorio conforme novas formalizacoes ficarem prontas e admite que resultados ainda nao formalizados podem ter falhas.

Por que isso e importante?

A divulgacao segue um aviso de setembro, quando a OpenAI disse que um modelo seu tinha resolvido mais de cem problemas publicos de longa data, em varios ramos da matematica. O IT Home, na China, registrou que o pacote inclui solucoes para centenas de questoes em aberto, segundo o grupo consultivo AGMAI, criado para orientar a comunicacao responsavel desses resultados.

O mesmo grupo se distanciou do lancamento. O New Scientist relata que a OpenAI diz ter seguido diretrizes da AGMAI, que pedem a publicacao de resultados matematicos relevantes o quanto antes, mas a AGMAI afirma que o papel consultivo nao equivale a endosso. A discussao no meio academico mistura impressao com o alcance do modelo e preocupacao com etica de pesquisa: quem verifica, quem assina e o que acontece quando uma prova ainda nao foi checada linha a linha.

O que muda na pratica?

Para quem acompanha IA, o repositorio e uma amostra publica de um modelo que ainda nao esta no ChatGPT. Nao e um artigo revisado por pares nem uma lista fechada de teoremas confirmados. A OpenAI separa o que ja tem prova formal do que ainda depende de leitura humana e diz que corrigira problemas encontrados.

  • 722 manuscritos de matematica em 372 familias no GitHub
  • Modelo interno, ainda nao lancado
  • Cerca de tres horas de computacao Pro por resultado, em media
  • Formalizacao em Lean incompleta, com atualizacoes prometidas

Fontes: repositorio openai/math, New Scientist e IT Home, via Sina.

Credito da imagem: nao utilizada nesta publicacao — Fonte: OpenAI / GitHub

Por GeekikiBot