OpenAI heeft dinsdag 722 wiskundige manuscripten vrijgegeven, gebundeld in 372 zogeheten “result families”, allemaal afkomstig van een intern AI‑model dat publiek niet kan worden gebruikt. Het is nu aan de wiskundige gemeenschap om te beoordelen of OpenAI zich aan de nieuwe richtlijnen voor publicatie heeft gehouden.
Belangrijkste punten:
- OpenAI plaatste 722 manuscripten in 372 families op GitHub, volledig gegenereerd door een intern model dat niet publiek toegankelijk is.
- Een onafhankelijke adviesgroep van wiskundigen benadrukt dat haar betrokkenheid géén goedkeuring inhoudt van de resultaten of van OpenAI’s werkwijze.
- Het bedrijf erkent dat resultaten zonder formele computercontrole fouten kunnen bevatten.
OpenAI deelt AI‑wiskunde
Het bedrijf heeft de collectie gepubliceerd in een openbaar GitHub‑repository, met spelregels voor hoe elk artikel mag worden aangepast en geciteerd. In de repository staan 722 manuscripten in 372 families. Zo’n family groepeert een hoofdresultaat met bijbehorende argumenten, consequenties of alternatieve bewijzen. Volgens OpenAI kreeg het model ongeveer 4.000 wiskundige problemen voorgelegd; alleen resultaten die intern als voldoende belangrijk werden gezien, zijn bewaard.
Per resultaat werd gemiddeld zo’n drie uur aan ChatGPT Pro‑rekenwerk besteed, aldus het bedrijf. Veel bewijzen zijn daarnaast uitgeschreven in Lean, een programmeertaal waarmee een computer wiskundige bewijzen formeel kan verifiëren.
OpenAI erkent dat resultaten zonder zo’n Lean‑check fouten of hiaten kunnen bevatten.
Lees ook: Noord‑Korea’s Lazarus versluisde $1 mrd via Chinese witwassers, stelt ZachXBT
Voorzichtigheid van adviesgroep
De Advisory Group on Mathematics and Artificial Intelligence, bestaande uit negen onbetaalde wiskundigen en ondergebracht bij het Institute for Advanced Study, stelt dat haar rol noch neerkomt op inhoudelijke beoordeling van de resultaten, noch op een steunbetuiging aan OpenAI’s proces. Alleen de bredere wiskundige gemeenschap kan volgens de groep inschatten in hoeverre het bedrijf de aanbevelingen heeft gevolgd.
Die aanbevelingen, gepubliceerd op 29 september, dringen er bij AI‑labs onder meer op aan eerdere literatuur correct te citeren, bewijzen in de stijl van traditionele papers te schrijven en prompts, redeneersamenvattingen en rekenkosten te documenteren. Ook zouden resultaten moeten worden ondergebracht in wetenschappelijke repositories die niet onder zeggenschap van een AI‑lab vallen. OpenAI zegt nog te zoeken naar community‑gehoste alternatieven voor GitHub en wil workshops financieren rond belangrijke AI‑resultaten.
Melanie Matchett Wood, hoogleraar wiskunde aan Harvard en lid van de adviesgroep, waarschuwde in september openlijk dat AI‑gegenereerde wiskunde “vaak plagiaat bevat” en zelden iemand kent die daar persoonlijk verantwoordelijkheid voor wil nemen. Een woordvoerder van het bedrijf erkende daarnaast dat veel van de nieuwe resultaten nog niet volledig worden begrepen door de eigen wiskundigen van OpenAI.
Conflict rond OpenAI en Navier‑Stokes
De publicatie volgt op een maand van spanningen tussen OpenAI en wiskundigen. Op 8 september claimde het bedrijf een oplossing te hebben voor het Navier‑Stokes Millennium Prize‑probleem, wat leidde tot een felle creditsstrijd met Tristan Buckmaster, wiskundige aan de New York University.
Drie dagen later tekenden 25 Fieldsmedaille‑winnaars een verklaring tegen het gebruik van beroemde open problemen als benchmark voor AI‑systemen. Op 21 september meldde OpenAI bovendien dat het model meer dan 100 andere problemen had opgelost.
Lees verder: AMD ziet AI‑vraag zo hard stijgen dat chipaanbod in 2027 ‘fors’ kan worden opgeschaald

