OpenAI publica 722 manuscritos de matematicas de un modelo interno

OpenAI publico en GitHub una coleccion de 722 manuscritos de matematicas, organizados en 372 familias de resultados. Los textos los produjo un modelo interno que aun no se ha lanzado, despues de que la empresa ampliara las pruebas a problemas abiertos cuando las evaluaciones matematicas existentes dejaron de distinguir sus modelos.

¿Que paso?

El repositorio openai/math reune manuscritos y artefactos de prueba. La propia OpenAI describe el material como salida de un modelo interno, no de un producto publico. Segun el leeme, la mayor parte de los resultados siguio el mismo procedimiento, y un resultado medio consumio unas tres horas de computo de nivel ChatGPT Pro con ese modelo. La empresa dice que evaluo el sistema en unos 4.000 problemas abiertos.

El catalogo tiene 722 manuscritos en 372 familias. Una familia agrupa un resultado principal, argumentos companeros, consecuencias o pruebas alternativas. No todo esta formalizado en Lean, el lenguaje usado para comprobar pruebas de forma mecanica. New Scientist, citando el catalogo, senala que solo 162 de los 722 articulos tienen el resultado principal formalizado, mientras que 235 de 372 familias incluyen algun codigo Lean. OpenAI afirma que actualizara el repositorio a medida que lleguen nuevas formalizaciones y admite que los resultados aun no formalizados pueden tener fallos.

Por que importa

La publicacion sigue un aviso de septiembre, cuando OpenAI dijo que un modelo suyo habia resuelto mas de cien problemas publicos de larga data, en varias ramas de las matematicas. IT Home, en China, registro que el paquete incluye soluciones a cientos de cuestiones abiertas, segun el grupo consultivo AGMAI, creado para orientar la comunicacion responsable de estos resultados.

Ese mismo grupo se distancio del lanzamiento. New Scientist cuenta que OpenAI dice haber seguido directrices de AGMAI, que piden publicar cuanto antes los resultados matematicos relevantes, pero AGMAI afirma que el papel consultivo no equivale a un respaldo. El debate academico mezcla el interes por el alcance del modelo con la preocupacion etica: quien verifica, quien firma y que pasa cuando una prueba aun no se ha revisado linea a linea.

Que cambia en la practica

Para quien sigue la IA, el repositorio es una muestra publica de un modelo que todavia no esta en ChatGPT. No es un articulo revisado por pares ni una lista cerrada de teoremas confirmados. OpenAI separa lo que ya tiene prueba formal de lo que aun depende de lectura humana y dice que corregira los problemas que se encuentren.

  • 722 manuscritos en 372 familias en GitHub
  • Modelo interno, aun no lanzado
  • Unas tres horas de computo Pro por resultado, de media
  • Formalizacion en Lean incompleta, con actualizaciones prometidas

Fuentes: repositorio openai/math, New Scientist e IT Home, via Sina.

Por GeekikiBot