OpenAIs große Charge KI-generierter mathematischer Ergebnisse
OpenAI hat einen umfangreichen Katalog KI-erzeugter Mathematik veröffentlicht: 722 Manuskripte, die in 372 „Ergebnisfamilien“ gruppiert sind und von einem internen, nicht freigegebenen Modell erzeugt wurden. Nach Angaben des Unternehmens wurden dem Modell etwa 4.000 Probleme vorgelegt, und OpenAI veröffentlichte die Teilmenge der Ausgaben, die es als bedeutsam einstufte. Die Sammlung deckt Zahlentheorie, algebraische Geometrie, Analysis und theoretische Informatik ab. Einige Ergebnisse liegen mit Lean 4-Formalisationen vor, also maschinenprüfbaren Beweisen, doch die Berichte unterscheiden sich hinsichtlich des Ausmaßes: Frühere Angaben nannten 162 Lean-geprüfte Manuskripte, spätere Zählungen sprechen von etwa 42% der Sammlung (rund 300). OpenAI selbst warnte, dass nicht alle Manuskripte formalisiert seien und „einige der nicht formalisierten Ergebnisse Probleme haben könnten“.
Im Mittelpunkt der Kritik stehen Nachprüfbarkeit und Transparenz. OpenAI stellte die Ergebnisse auf GitHub bereit, veröffentlichte aber nicht das zugrundeliegende Modell oder die verwendeten Prompts; im Repository sind Issues deaktiviert und es wurden keine Pull Requests angenommen, was direkte Community-Interaktion einschränkt. Zugleich stellte die Firma durchschnittliche Rechenaufwände und zehn komprimierte Begründungszusammenfassungen bereit und gab an, mit einer Advisory Group for Mathematics and Artificial Intelligence sowie mit Empfehlungen des Institute for Advanced Study zusammengearbeitet zu haben. Bedeutende Mathematiker wie Andrew Sutherland fordern jedoch die Veröffentlichung von Modell und Prompts, damit die Resultate unabhängig reproduzierbar werden; andere Forscher begrüßen die Freigabe als wichtigen Impuls für die Forschung.
Wesentliche Kontextelemente sind bekannt: OpenAI hatte zuvor Fortschritte an der Navier–Stokes-Frage gemeldet, ein Vorhaben, das Berichten zufolge etwa 10.000 koordinierte Agenten über 88 Stunden einsetzte. In der aktuellen Publikationswelle wurden kurz nach der Freigabe mindestens drei Manuskripte wegen Fehlern zurückgezogen. Die unmittelbare Aufgabe der mathematischen Gemeinschaft ist eine Triage: Vorrang sollten die circa 300 Ergebnisse mit Lean-Formalisation erhalten, beobachtet werden müssen weitere Rückzüge, unabhängige Prüfungen insbesondere der Riemann-nahen Aussagen und ob OpenAI letztlich Modell, Prompts und detailliertere methodische Angaben veröffentlicht, wie es die Empfehlungen der Advisory Group nahelegten.