KI-Fortschritte in der Mathematik teilen
Wir veröffentlichen eine breite Auswahl neuer mathematischer Ergebnisse, die ein internes Frontier-Modell erzielt hat.
Wir möchten einheitliche Standards dafür schaffen, wie wir Ergebnisse mit der mathematischen Fachgemeinschaft teilen. Dazu beraten wir uns mit der unabhängigen Advisory Group on Mathematics and Artificial Intelligence at the Institute for Advanced Study(wird in einem neuen Fenster geöffnet), um bewährte Vorgehensweisen zu entwickeln. Ihre Ratschläge und öffentlichen Empfehlungen(wird in einem neuen Fenster geöffnet) fließen in die Veröffentlichung dieser Ergebnisse ein.
Diese Ergebnisse veröffentlichen wir in einem GitHub-Repository mit Vorgaben für die Überarbeitung wissenschaftlicher Arbeiten und für Quellenangaben. Wir prüfen weiterhin alternative, von der Fachgemeinschaft betriebene Plattformen für diese Veröffentlichung, die den Richtlinien des Gremiums entsprechen. Für künftige Veröffentlichungen wollen wir die Qualität der Arbeiten weiter verbessern: durch bessere Quellenangaben, mathematische Erläuterungen und eine verständlichere Darstellung der Ergebnisse.
In unserem GitHub-Repository teilen wir Formalisierungen vieler Beweise in Lean, einer Programmiersprache, mit der sich mathematische Beweise durch einen Computer überprüfen lassen. Wir werden das Repository um weitere Formalisierungen ergänzen, sobald sie vorliegen.
Um wissenschaftliche Transparenz und Offenheit zu fördern, veröffentlichen wir im Repository außerdem weitere Einzelheiten dazu, wie wir die Ergebnisse erzielt haben. Dazu gehören zehn Zusammenfassungen des Reasonings des Modells, Schätzungen zum Rechenaufwand, gemessen an der Nutzung von Pro in ChatGPT, sowie Statistiken zur Anzahl der Probleme, deren Lösung versucht wurde. Der Rechenaufwand pro Ergebnis entsprach im Durchschnitt etwa drei Stunden Denkzeit von ChatGPT Pro.
Wir möchten mit diesen Fortschritten die Grenzen des menschlichen Wissens erweitern und weitere Fortschritte in der Mathematik ermöglichen. Wir werden eine Reihe von Workshops, Konferenzen und speziellen Programmen finanzieren, die das Verständnis bedeutender KI-generierter Ergebnisse fördern. Dazu werden wir in Kürze mehr mitteilen.
Wir möchten Forschenden modernste Funktionen direkt zur Verfügung stellen und arbeiten daran, das Modell, das diese Ergebnisse erzielt hat, verantwortungsvoll zu veröffentlichen. Deshalb ist es wichtig, unsere internen Frontier-Modelle weiterhin in der Mathematik und anderen Wissenschaften zu evaluieren. So können wir schneller Werkzeuge entwickeln, die diese Fachgebiete voranbringen. Wir werden weiterhin Rückmeldungen aus der Fachgemeinschaft aufgreifen und unsere Standards für künftige Veröffentlichungen bedeutender wissenschaftlicher Fortschritte anpassen.


