OpenAI hat am Dienstag 722 mathematische Manuskripte in 372 Ergebnisfamilien offengelegt, die vollständig von einem internen, nicht öffentlich zugänglichen KI-Modell erzeugt wurden. Nun muss die mathematische Fachwelt beurteilen, ob die Arbeit den neuen Veröffentlichungsleitlinien folgt – und ob die Ergebnisse tragen.
Wichtigste Punkte:
- OpenAI stellte 722 Manuskripte in 372 Familien auf GitHub online, alle stammen von einem internen Modell, das der Öffentlichkeit nicht zur Verfügung steht.
- Eine unabhängige Beratergruppe aus Mathematikerinnen und Mathematikern betont, ihre Rolle bedeute weder eine inhaltliche Abnahme noch eine Billigung des OpenAI-Prozesses.
- Das Unternehmen räumt ein, dass Resultate ohne formale Computerverifikation fehlerhaft sein können.
OpenAI öffnet KI-Math-Archiv
Das Unternehmen hat die Sammlung in einem öffentlichen GitHub-Repository veröffentlicht und dort Regeln für Überarbeitungen und Zitierweise der Arbeiten festgelegt. Im Repository finden sich 722 Manuskripte, gebündelt in 372 „Familien“. Eine Familie fasst ein zentrales Resultat mit zugehörigen Argumenten, Folgerungen oder alternativen Beweisen zusammen. OpenAI gibt an, dem Modell rund 4.000 Aufgaben vorgelegt und nur Resultate behalten zu haben, die intern als hinreichend bedeutend eingestuft wurden.
Nach Unternehmensangaben benötigte jedes Resultat im Schnitt rund drei Stunden Rechenzeit auf ChatGPT Pro. Viele Beweise liegen zusätzlich in Lean vor – einer Programmiersprache für formal verifizierte Mathematik, mit der Computer Beweise schrittweise nachprüfen können.
Gleichzeitig warnt OpenAI, dass Resultate ohne Lean-Formalisierung oder andere Computerchecks fehlerhaft oder unvollständig sein können.
Lesen Sie auch: Nordkoreas Lazarus verschob 1 Mrd. Dollar Beute über chinesische Geldwäscher, behauptet ZachXBT
Vorsicht der Beratungsgruppe
Die Advisory Group on Mathematics and Artificial Intelligence, neun nicht vergütete Mathematikerinnen und Mathematiker mit Sitz am Institute for Advanced Study, stellte in einer Erklärung klar, dass ihre Beteiligung weder als Bewertung der Resultate noch als Gütesiegel für OpenAIs Vorgehen zu verstehen sei. Nur die breitere mathematische Community könne einschätzen, inwieweit OpenAI den Empfehlungen der Gruppe gefolgt sei.
Die am 29. September veröffentlichten Empfehlungen verlangen von KI-Laboren unter anderem, frühere Arbeiten korrekt zu zitieren, Beweise im Stil klassischer Fachartikel zu verfassen sowie Prompts, zusammenfassende Beweisideen und Rechenaufwand offenzulegen. Zudem sollen neue Resultate in wissenschaftlichen Repositorien hinterlegt werden, die nicht von einem KI-Unternehmen kontrolliert werden. OpenAI erklärte, man prüfe Community-gehostete Alternativen zu GitHub und wolle Workshops zu wichtigen KI-Resultaten finanzieren.
Melanie Matchett Wood, Mathematikprofessorin in Harvard und Mitglied der Gruppe, warnte bereits im September in einem Interview, dass KI-generierte Mathematik „häufig Plagiate“ enthalte und meist niemand bereitstehe, persönlich Verantwortung dafür zu übernehmen. Ein Unternehmenssprecher räumte zudem ein, dass viele der nun veröffentlichten Resultate selbst von OpenAIs eigenen Mathematikern noch nicht vollständig verstanden seien.
Streit um OpenAIs Navier-Stokes-Behauptung
Die jetzige Veröffentlichung folgt auf einen Monat zunehmender Spannungen zwischen OpenAI und der Mathematik-Community. Am 8. September hatte das Unternehmen verlautbart, sein Modell habe das Navier-Stokes-Problem der Millennium-Probleme gelöst – eine Behauptung, die rasch in einen Streit um Anerkennung und Urheberschaft mit dem NYU-Mathematiker Tristan Buckmaster mündete.
Nur drei Tage später unterzeichneten 25 Fields-Medaillenträger eine Erklärung, die den Einsatz prominenter offener Probleme als Benchmark für KI kritisiert. Am 21. September legte OpenAI nach und erklärte, das Modell habe zudem mehr als 100 weitere Probleme gelöst.
Als Nächstes lesen: AMD erwartet so hohe KI-Nachfrage, dass sie das Chipangebot 2027 „deutlich“ ausweiten wird

