Ein experimentelles Modell künstlicher Intelligenz hat Hunderte mathematische Forschungsmanuskripte erstellt, die nun Fachleuten auf der ganzen Welt zugänglich sind.
Am 6. Oktober 2026 veröffentlichte OpenAI einen Katalog von Arbeiten, die mit einem noch experimentellen internen Modell erstellt wurden. Das auf GitHub gehostete Repository umfasst 719 Manuskripte aus 372 Ergebnisfamilien. Eine Familie kann mehrere Beweise, alternative Methoden oder Konsequenzen ein und derselben vorgeschlagenen Entdeckung umfassen.

Eine transparente Tafel voller mathematischer Symbole und Gleichungen. Von einer KI vorgeschlagene mathematische Arbeiten müssen überprüft werden, bevor sie als bewiesen gelten können.
Foto: Preply.com Images, Creative-Commons-Namensnennungslizenz, via Wikimedia Commons.
Wikimedia-Bild
Diese Dokumente betreffen sehr unterschiedliche Zweige der Mathematik: Zahlentheorie, Geometrie, Algebra und mathematische Physik. Sie ähneln daher keineswegs einer Reihe automatisch gelöster Schulaufgaben. Einige befassen sich mit Forschungsproblemen, die seit vielen Jahren untersucht werden.
Wie konnte eine solche Menge an Texten erstellt werden? OpenAI erklärt, während der Evaluierung etwa 4.000 Probleme an das Modell übermittelt zu haben. Im Durchschnitt habe jedes ausgewählte Ergebnis das Äquivalent von etwa drei Stunden intensiver Rechenzeit in ChatGPT Pro erfordert. Anschließend haben die Forschenden die Arbeiten und ihre Dokumentation organisiert, um sie zugänglich zu machen.
Doch ein Manuskript ist noch keine bestätigte Entdeckung. Ein Beweis kann einen unauffälligen Fehler enthalten, eine zu starke Annahme verwenden oder ein bereits bekanntes Ergebnis herleiten. Daher müssen Fachleute sowohl die Argumentation als auch die wissenschaftliche Bedeutung und die Neuartigkeit jedes Vorschlags überprüfen.
Das Repository liefert bereits ein konkretes Beispiel dafür. Am 7. Oktober entfernte OpenAI drei Manuskripte, nachdem ein Vorzeichenfehler in einem Beweis festgestellt worden war. Vierzehn weitere Texte wurden überarbeitet, um Argumente zu korrigieren, Bedingungen zu präzisieren oder Beweise zu reparieren. Der Katalog wird somit als eine Sammlung fortlaufend weiterentwickelter Arbeiten präsentiert.
Um die Überprüfung zu erleichtern, wurden einige Beweise in Lean übertragen, eine Sprache, mit der ein Computer die Schritte eines formalen Beweises überprüfen kann. Derzeit verfügen etwa 42 % der Hauptergebnisse über eine Formalisierung. Dies hilft dabei, ihre logische Konsistenz zu überprüfen, reicht jedoch nicht aus, um ihre Neuartigkeit oder die Bedeutung der gelösten Fragen festzustellen.
Die entscheidende Frage ist, ob KI inzwischen zu echten mathematischen Fortschritten beitragen und anschließend hinreichend präzise Argumente hervorbringen kann, damit Forschende sie prüfen können. Die offene Veröffentlichung ermöglicht es gerade, diese Vorschläge der wissenschaftlichen Gemeinschaft zur Diskussion zu stellen.
OpenAI plant, weitere formale Beweise hinzuzufügen und Treffen zur Bewertung dieser Arbeiten zu organisieren. Das Repository bewahrt außerdem die Historie der Korrekturen und Rücknahmen. Die nächsten unabhängigen Überprüfungen werden zeigen, welche Vorschläge der Prüfung standhalten und welche noch geändert werden müssen.