Op 7 oktober 2026 registreerde OpenAI de intrekking van drie wiskundemanuscripten: een tekenfout maakte een argument en een constructie ongeldig die in twee afhankelijke artikelen werd gebruikt. Dat volgde op de publicatie van de resultaten op 6 oktober, die OpenAI toeschreef aan een intern frontiermodel. De geschiedenis van de repository vermeldt daarnaast aanpassingen aan 14 andere manuscripten en bijgewerkte verwijzingen in nog eens 13.

Waarom trok OpenAI drie manuscripten terug?

Een tekenfout kan een bewijsstap onderuit halen. In dit geval trof de fout ook een constructie waarop twee andere artikelen voortbouwden. OpenAI registreerde daarom drie intrekkingen in de repositorygeschiedenis van 7 oktober.

Wat staat er in de OpenAI-wiskunderepository?

De OpenAI Math-repository telt momenteel 719 manuscripten, gegroepeerd in 372 families. Een familie bundelt verwante artikelen, bijvoorbeeld rond een hoofdresultaat, bijbehorende argumenten, gevolgen of alternatieve bewijzen. De aantallen hebben dus betrekking op verschillende eenheden: manuscripten zijn afzonderlijke teksten, families zijn groepen verwante teksten.

OpenAI maakte de verzameling op 6 oktober openbaar. Het bedrijf zei dat de evaluatie ongeveer 4.000 open problemen omvatte en dat een gemiddeld resultaat rekentijd gebruikte die overeenkwam met ongeveer drie uur ChatGPT Pro-denktijd.

Wat betekent formalisering in Lean?

Lean is een bewijsassistent: software waarmee een formeel opgeschreven bewijs door een computer kan worden gecontroleerd. Volgens OpenAI’s repositorygeschiedenis waren 300 van de 719 hoofdresultaten, ongeveer 42%, in Lean geformaliseerd.

Dat percentage beschrijft hoeveel hoofdresultaten een Lean-formalisering hadden; het is geen telling van alle manuscripten die formeel zijn gecontroleerd. Een formeel bewijs geeft de computer een controleerbare reeks stappen, maar zegt op zichzelf niet hoe belangrijk of begrijpelijk een wiskundig resultaat is.

Hoe ver zijn de resultaten gecontroleerd?

OpenAI beschrijft de verzameling als werk in verschillende verificatiestadia. Niet alle resultaten hebben een Lean-formalisering, en volgens OpenAI kunnen ongeformaliseerde resultaten fouten bevatten.