OpenAI zet 722 AI-wiskundepapers online, nu is het oordeel aan de wiskundigen

Alexey Bondarev
Alexey Bondarev47 minuten geleden
Mathematicians must judge 722 math manuscripts that an unreleased OpenAI model produced and the company posted publicly (Image: Shutterstock)
Mathematicians must judge 722 math manuscripts that an unreleased OpenAI model produced and the company posted publicly (Image: Shutterstock)

OpenAI heeft dinsdag 722 wiskundige manuscripten vrijgegeven, gebundeld in 372 zogeheten “result families”, allemaal afkomstig van een intern AI‑model dat publiek niet kan worden gebruikt. Het is nu aan de wiskundige gemeenschap om te beoordelen of OpenAI zich aan de nieuwe richtlijnen voor publicatie heeft gehouden.

Belangrijkste punten:

  • OpenAI plaatste 722 manuscripten in 372 families op GitHub, volledig gegenereerd door een intern model dat niet publiek toegankelijk is.
  • Een onafhankelijke adviesgroep van wiskundigen benadrukt dat haar betrokkenheid géén goedkeuring inhoudt van de resultaten of van OpenAI’s werkwijze.
  • Het bedrijf erkent dat resultaten zonder formele computercontrole fouten kunnen bevatten.

OpenAI deelt AI‑wiskunde

Het bedrijf heeft de collectie gepubliceerd in een openbaar GitHub‑repository, met spelregels voor hoe elk artikel mag worden aangepast en geciteerd. In de repository staan 722 manuscripten in 372 families. Zo’n family groepeert een hoofdresultaat met bijbehorende argumenten, consequenties of alternatieve bewijzen. Volgens OpenAI kreeg het model ongeveer 4.000 wiskundige problemen voorgelegd; alleen resultaten die intern als voldoende belangrijk werden gezien, zijn bewaard.

Per resultaat werd gemiddeld zo’n drie uur aan ChatGPT Pro‑rekenwerk besteed, aldus het bedrijf. Veel bewijzen zijn daarnaast uitgeschreven in Lean, een programmeertaal waarmee een computer wiskundige bewijzen formeel kan verifiëren.

OpenAI erkent dat resultaten zonder zo’n Lean‑check fouten of hiaten kunnen bevatten.

Lees ook: Noord‑Korea’s Lazarus versluisde $1 mrd via Chinese witwassers, stelt ZachXBT

Voorzichtigheid van adviesgroep

De Advisory Group on Mathematics and Artificial Intelligence, bestaande uit negen onbetaalde wiskundigen en ondergebracht bij het Institute for Advanced Study, stelt dat haar rol noch neerkomt op inhoudelijke beoordeling van de resultaten, noch op een steunbetuiging aan OpenAI’s proces. Alleen de bredere wiskundige gemeenschap kan volgens de groep inschatten in hoeverre het bedrijf de aanbevelingen heeft gevolgd.

Die aanbevelingen, gepubliceerd op 29 september, dringen er bij AI‑labs onder meer op aan eerdere literatuur correct te citeren, bewijzen in de stijl van traditionele papers te schrijven en prompts, redeneersamenvattingen en rekenkosten te documenteren. Ook zouden resultaten moeten worden ondergebracht in wetenschappelijke repositories die niet onder zeggenschap van een AI‑lab vallen. OpenAI zegt nog te zoeken naar community‑gehoste alternatieven voor GitHub en wil workshops financieren rond belangrijke AI‑resultaten.

Melanie Matchett Wood, hoogleraar wiskunde aan Harvard en lid van de adviesgroep, waarschuwde in september openlijk dat AI‑gegenereerde wiskunde “vaak plagiaat bevat” en zelden iemand kent die daar persoonlijk verantwoordelijkheid voor wil nemen. Een woordvoerder van het bedrijf erkende daarnaast dat veel van de nieuwe resultaten nog niet volledig worden begrepen door de eigen wiskundigen van OpenAI.

Conflict rond OpenAI en Navier‑Stokes

De publicatie volgt op een maand van spanningen tussen OpenAI en wiskundigen. Op 8 september claimde het bedrijf een oplossing te hebben voor het Navier‑Stokes Millennium Prize‑probleem, wat leidde tot een felle creditsstrijd met Tristan Buckmaster, wiskundige aan de New York University.

Drie dagen later tekenden 25 Fieldsmedaille‑winnaars een verklaring tegen het gebruik van beroemde open problemen als benchmark voor AI‑systemen. Op 21 september meldde OpenAI bovendien dat het model meer dan 100 andere problemen had opgelost.

Lees verder: AMD ziet AI‑vraag zo hard stijgen dat chipaanbod in 2027 ‘fors’ kan worden opgeschaald

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev is Head of Content bij Yellow.com. Hij specialiseert zich in diepgaande Research- en Learn-artikelen, met een focus op analytische rapportage, industriële context en de grotere krachten die de crypto-industrie vormgeven, van het AI-tijdperk en beveiligingstechnologieën tot fintech-innovatie. Hij gelooft dat alles wat digitaal is binnenkort alles wat analoog is zal overtreffen en werkt er hard aan om dat te laten uitkomen.

Disclaimer en risicowaarschuwing: De informatie in dit artikel is uitsluitend voor educatieve en informatieve doeleinden en is gebaseerd op de mening van de auteur. Het vormt geen financieel, investerings-, juridisch of belastingadvies. Cryptocurrency-assets zijn zeer volatiel en onderhevig aan hoog risico, inclusief het risico om uw gehele of een substantieel deel van uw investering te verliezen. Het handelen in of aanhouden van crypto-assets is mogelijk niet geschikt voor alle beleggers. De meningen die in dit artikel worden geuit zijn uitsluitend die van de auteur(s) en vertegenwoordigen niet het officiële beleid of standpunt van Yellow, haar oprichters of haar leidinggevenden. Voer altijd uw eigen grondig onderzoek uit (D.Y.O.R.) en raadpleeg een gelicentieerde financiële professional voordat u een investeringsbeslissing neemt.
OpenAI zet 722 AI-wiskundepapers online, nu is het oordeel aan de wiskundigen | Yellow