El 7 de octubre, OpenAI registró en el historial de su repositorio la retirada de tres manuscritos, después de que un error de signo invalidara un argumento clave y una construcción utilizada por dos trabajos dependientes. La novedad llegó un día después de que la empresa publicara sus resultados matemáticos y de que la Association for Human Mathematics (AHM) criticara el volumen y el formato de la publicación. OpenAI publicó el repositorio el 6 de octubre.
Por qué retiró OpenAI tres manuscritos
El historial del repositorio de OpenAI atribuyó las retiradas a un error de signo que afectó a un argumento de cancelación de la traza de estabilización y a una construcción empleada por dos trabajos dependientes. Los tres manuscritos retirados fueron Algebraicity of Weil classes on split abelian eightfolds, Algebraicity of Kuga–Satake Correspondences for K3 Surfaces y The rational Hodge conjecture for products of K3 surfaces.
El debate sobre los resultados matemáticos de OpenAI también llega después de otros anuncios de la empresa. NeoTeo ya había abordado el resultado relacionado con Navier–Stokes en su cobertura anterior.
La crítica de la AHM a la publicación
La AHM sostuvo que la publicación de más de 700 archivos de una sola vez no era una demostración de trabajo académico, sino de poder. También pidió a los matemáticos que dejaran de colaborar con OpenAI y defendió una visión de la ciencia centrada en la comprensión humana. La organización expresó así su crítica al volumen y al modo de presentar el repositorio, no una evaluación individual de cada resultado. La AHM publicó su postura.
Qué explicó OpenAI sobre su publicación
OpenAI indicó que el repositorio incluía protocolos de revisión de artículos y de citación. También afirmó que había consultado al Institute for Advanced Study Advisory Group on Mathematics and Artificial Intelligence y que incorporaría sus recomendaciones a sus prácticas de publicación.
La empresa dijo que publicó diez resúmenes de razonamiento, estimaciones de cómputo y estadísticas sobre problemas intentados. Situó en unas tres horas, de media por resultado, el cómputo de razonamiento equivalente al uso de ChatGPT Pro.
Qué mide el recuento de Lean
En la entrada del 7 de octubre, OpenAI contabilizó 300 de 719 resultados principales formalizados en Lean, aproximadamente el 42 %. Lean es un asistente de demostración: permite expresar pruebas en un formato que un sistema puede comprobar a partir de las definiciones y los supuestos codificados.
Ese recuento describe cuántos resultados tenían una formalización en Lean. La revisión de lo que demuestra una prueba y su relevancia matemática es una tarea distinta.
Otros cambios registrados el 7 de octubre
Además de las tres retiradas, el historial de OpenAI anotó revisiones en otros 14 manuscritos, actualizaciones de citas en otros 13 para reflejar versiones revisadas de trabajos relacionados y seis formalizaciones adicionales.