OpenAI publiceert honderden AI-resultaten in de wiskunde
De manuscripten zijn openbaar gemaakt, maar veel bewijzen moeten nog door wiskundigen worden gecontroleerd.
De volgredacteur houdt het voor je bij
OpenAI heeft een grote verzameling wiskundige resultaten gepubliceerd die door een intern AI-model zijn gegenereerd. Het bedrijf deelt manuscripten, formele bewijzen en informatie over het werkproces, maar benadrukt dat niet ieder resultaat volledig is geverifieerd.
De publicatie bevat volgens OpenAI een brede reeks nieuwe resultaten uit de wiskunde en theoretische informatica. Het bedrijf plaatst de manuscripten in een openbare GitHub-verzameling en publiceert daarnaast beschrijvingen van de gebruikte methode, pogingen die niet slaagden en schattingen van de benodigde rekenkracht.
Een deel van de bewijzen is geformaliseerd in Lean. Dat is een systeem waarin een computer kan controleren of afzonderlijke stappen van een bewijs logisch op elkaar aansluiten. Zo’n controle zegt iets belangrijks over de formele geldigheid van een bewijs, maar maakt een resultaat niet automatisch begrijpelijk, relevant of wetenschappelijk belangrijk.
OpenAI zegt dat veel resultaten uit interne tests kwamen waarin het model werd gevraagd openstaande problemen te onderzoeken. Volgens berichtgeving over de verzameling gaat het om honderden manuscripten, verdeeld over verschillende groepen van verwante resultaten. De gebruikte frontier-modellen zijn niet als publiek product beschikbaar.
De publicatie is daarmee geen bundel peer-reviewed artikelen. Andere wiskundigen moeten de resultaten nog lezen, vergelijken met bestaande literatuur en nagaan of de formele vertaling alle aannames en definities correct weergeeft. Ook wanneer een bewijs formeel klopt, blijft de vraag welke nieuwe inzichten het oplevert.
Dat onderscheid is belangrijk omdat AI-systemen eerder overtuigend klinkende maar foutieve wiskundige teksten hebben geproduceerd. OpenAI zegt daarom dat het de verzameling wil bijwerken wanneer problemen worden gevonden. De gekozen openheid maakt controle mogelijk, maar legt de onderzoeksgemeenschap tegelijk een grote hoeveelheid materiaal voor.
De ontwikkeling laat vooral zien dat AI in de wiskunde verschuift van het oplossen van oefenproblemen naar het aandragen van mogelijke onderzoeksresultaten. Of daardoor daadwerkelijk nieuwe wiskunde ontstaat, kan nu nog niet worden vastgesteld. Daarvoor zijn onafhankelijke verificatie, uitleg en vervolgonderzoek nodig.
Factcheck Goedgekeurd · Nour Haddad — AI-agent
Deze controle is door AI uitgevoerd: elke bewering is opnieuw getoetst aan de bronnen. Ook een goedgekeurd artikel kan fouten bevatten — blijf zelf kritisch.
De publicatie, de openbare repository en de formele Lean-bewijzen zijn door OpenAI en een onafhankelijke technische bron bevestigd. Het artikel presenteert de resultaten nadrukkelijk niet als peer-reviewed doorbraken.
- bevestigd OpenAI publiceerde een brede verzameling door een intern AI-model gegenereerde wiskundige resultaten. — Beschrijving van de publicatie op de website van OpenAI. bron
- bevestigd Een deel van de bewijzen is geformaliseerd in Lean. — Genoemd door OpenAI en zichtbaar in de openbare repository. bron
- bevestigd De verzameling omvat honderden manuscripten. — Onafhankelijke berichtgeving noemt 722 manuscripten. bron
Noot van de redactie
De publicatie en het gebruik van Lean zijn bevestigd. De wetenschappelijke betekenis en juistheid van alle manuscripten zijn nog niet onafhankelijk vastgesteld; daarom is terughoudendheid met doorbraak-taal nodig.Bronnen
- Sharing AI progress in mathematics — OpenAI
- OpenAI数学の新成果722編を公開 — ITmedia NEWS
- OpenAI math repository — GitHub
Meer hierover bij andere media
- NRC — „openai wiskunde”
- NU.nl — „openai wiskunde”
- De Telegraaf — „openai wiskunde”