AI-tools
OpenAI zegt dat nieuw AI-model tien lang onopgeloste wiskundeproblemen oploste
Een testversie van OpenAI's volgende grote model vond volgens het bedrijf oplossingen voor tien wiskunde- en informaticaproblemen die al minstens tien jaar vaststonden.
Op basis van OpenAI, Simon Willison, The Decoder, Techmeme en Wired
Samengesteld met AI-assistentie uit de onderstaande bronnen, onder redactie van Frederiek Pascal. Hoe dit werkt
In het kort
- OpenAI zegt dat een interne versie van zijn volgende model Astra tien wiskunde- en informaticaproblemen oploste die al minstens tien jaar vastzaten.
- Het bedrijf claimt dat elke oplossing minder dan 2.000 dollar aan rekenkosten kostte, berekend tegen de prijzen van het model GPT-5.6 Sol.
- OpenAI publiceerde de bewijzen in een formeel controleerbare vorm via het programma Lean 4, samen met een paper en een door AI geschreven reconstructie van het denkproces.
- Voor Vlaamse ondernemers verandert dit voorlopig niets aan de AI-tools die ze vandaag gebruiken: dit gaat over gespecialiseerd wiskundig onderzoek, niet over chatbots of klantenservice.
- Concurrent Deepseek lanceerde in dezelfde periode een goedkoper model dat qua prestaties bijna gelijk loopt met OpenAI's eigen budgetmodel, wat de prijsdruk in de sector aantoont.
OpenAI zegt dat een interne, nog niet uitgebrachte versie van zijn volgende grote model, met de werknaam Astra, oplossingen heeft gevonden voor tien wiskunde- en informaticaproblemen die volgens het bedrijf al minstens tien jaar geen vooruitgang hadden geboekt. Het gaat om vraagstukken uit onder meer meetkunde, cryptografie en complexiteitstheorie, een tak van de informatica die bestudeert hoe moeilijk bepaalde rekenproblemen zijn.
Het nieuws komt van OpenAI zelf, in een blogpost die het bedrijf publiceerde. Onafhankelijke bronnen die de resultaten al hebben nagekeken, zijn er op dit moment niet. Techsite Techmeme en blogger Simon Willison bevestigen wel dat OpenAI deze claim maakt, maar spreken zich niet uit over de wiskundige juistheid ervan.
Wat heeft OpenAI precies gedaan?
OpenAI liet zijn interne testmodel loslaten op tien problemen waar wiskundigen al lange tijd op vastliepen. Volgens het bedrijf kostte het oplossen van elk probleem minder dan 2.000 dollar aan rekenkracht, berekend tegen de prijzen van het bestaande model GPT-5.6 Sol. Wat niet vermeld wordt, is hoeveel problemen het model probeerde zonder tot een oplossing te komen: die mislukte pogingen tellen niet mee in de rekensom.
Om de resultaten controleerbaar te maken, publiceerde OpenAI de bewijzen in Lean 4, een programma waarmee wiskundige bewijzen stap voor stap formeel geverifieerd kunnen worden door een computer in plaats van door een mens die alles naleest. Daarnaast bracht het bedrijf een wetenschappelijk paper uit en een extra, door het model zelf geschreven document dat probeert te reconstrueren hoe het tot de oplossing kwam. Simon Willison noemt dat een behoorlijk niveau van openheid, maar merkt op dat de exacte instructies die aan het model gegeven werden, niet gedeeld zijn.
Waarom reageren wiskundigen zo verdeeld?
De reacties in de wiskundige gemeenschap lopen uiteen van fascinatie tot ongemak. Sommige onderzoekers vergelijken het moment met de schaakcomputer Deep Blue, wiens naam voor velen synoniem staat met het gevoel dat een machine plots iets kan wat lang als typisch menselijk terrein gold. Wiskundige Kirwin Hampshire publiceerde naar aanleiding van eerdere, kleinere AI-resultaten een essay over wat hij een diepe existentiële crisis binnen het vakgebied noemt.
Andere stemmen zijn minder somber. Wiskundige Terence Tao spreekt volgens IEEE Spectrum niet over verdringing, maar over een verschuiving richting wat hij grootschalige wiskunde noemt: samenwerkingen tussen mensen en machines, waarbij mensen het creatieve denkwerk doen en AI het technische rekenwerk overneemt.
Staat dit los van andere AI-ontwikkelingen?
Nee, het past in een bredere golf van AI-labs die hun modellen inzetten op complexe onderzoeksvraagstukken. Kort voor deze aankondiging meldde ook Anthropic dat het zijn AI-model Claude cryptografische zwakheden liet opsporen, met een aanzienlijk hoger budget dan de kosten die OpenAI nu claimt.
Ondertussen speelt er ook een prijzenoorlog tussen aanbieders. Het Chinese Deepseek bracht een nieuwe versie van zijn budgetmodel uit die volgens onafhankelijke metingen van Artificial Analysis bijna even goed scoort als OpenAI’s eigen goedkopere model, maar ongeveer 60 procent minder kost per taak. Dat toont aan dat de prijzen in de sector snel blijven dalen, ook als de duurdere topmodellen almaar geavanceerdere resultaten claimen.
Wat betekent dit voor gewone AI-gebruikers?
Voorlopig weinig concreet. Astra is nog niet uitgebracht als product en de tien wiskundige resultaten zijn een showcase van wat het model in een gecontroleerde onderzoeksomgeving kan, niet een functie die in een chatbot of bedrijfstool terechtkomt. De bronnen geven geen informatie over een lanceringsdatum, een prijs voor het uiteindelijke model, of hoe dit zich vertaalt naar dagelijkse toepassingen zoals klantenservice of tekstverwerking.
Wat betekent dit voor jou
Waarom deze claim voorlopig geen actie vraagt
- Vlaamse kmo's die AI-tools gebruiken voor dagelijkse taken Deze aankondiging gaat over een testversie van een toekomstig model in een onderzoeksomgeving, niet over een functie die in bestaande chatbots of software terechtkomt. Er is geen reden om nu iets aan te passen aan de tools die je vandaag gebruikt.
- Marketeers die AI-nieuws volgen om vooruitgang in te schatten Omdat de resultaten uitsluitend van OpenAI zelf komen en nog niet onafhankelijk zijn nagekeken, is het verstandig om de claim als marketing te lezen tot externe wiskundigen ze bevestigen. Neem grote doorbraakclaims van leveranciers niet als vaststaand feit over.
- Bedrijven die AI-modellen kiezen op prijs en prestatie De gelijktijdige lancering van een goedkoper Deepseek-model laat zien dat prijsconcurrentie tussen aanbieders blijft toenemen, los van welke aanbieder de meest opvallende onderzoeksresultaten claimt. Vergelijk bij een aankoopbeslissing altijd de prijs per taak, niet alleen de reputatie.
Veelgestelde vragen
Is het bewezen dat OpenAI's model echt tien wiskundeproblemen heeft opgelost?
OpenAI claimt dit zelf en publiceerde de bewijzen in een formeel controleerbaar formaat, Lean 4. Onafhankelijke wiskundigen hebben de resultaten op dit moment nog niet publiekelijk beoordeeld of bevestigd. Tot die onafhankelijke controle er is, blijft het vooral een claim van het bedrijf zelf, ook al is de gebruikte methode transparanter dan bij eerdere aankondigingen.
Wat is Astra, het model waarmee OpenAI dit deed?
Astra is de werknaam van het volgende grote model van OpenAI, dat op het moment van deze aankondiging nog niet publiek beschikbaar was. De resultaten kwamen van een interne testversie. Er is geen informatie over wanneer het model wel wordt uitgebracht of wat het gaat kosten voor gewone gebruikers.
Verandert dit iets aan de AI-tools die ik als ondernemer nu gebruik?
Nee, niet meteen. Dit gaat over gespecialiseerd onderzoek naar onopgeloste wiskundeproblemen, uitgevoerd met een testversie die nog niet als product bestaat. Voor de chatbots, schrijfhulpen of klantenservicetools die kmo's vandaag gebruiken, heeft deze aankondiging op zich geen directe gevolgen.
Hoeveel kostte het OpenAI om deze problemen op te lossen?
OpenAI zegt minder dan 2.000 dollar per probleem te hebben uitgegeven aan rekenkracht, berekend tegen de tarieven van het model GPT-5.6 Sol. Onvermeld blijft hoeveel problemen het model probeerde zonder tot een oplossing te komen, waardoor het echte totaalbudget van de hele oefening onduidelijk blijft.
Hoe verhoudt dit zich tot goedkopere modellen zoals Deepseek?
Los van deze wiskunderesultaten bracht Deepseek een nieuwe, goedkopere versie van zijn model uit die volgens onafhankelijke metingen bijna even goed presteert als OpenAI's eigen budgetmodel, tegen een aanzienlijk lagere prijs. Dat wijst op aanhoudende prijsdruk in de sector, los van de vraag of dure topmodellen zoals Astra unieke doorbraken kunnen claimen.
Bronnen
- OpenAI Ten advances in mathematics and theoretical computer science 1 aug, 02:00
- Simon Willison Ten advances in mathematics and theoretical computer science 1 aug, 22:34
- The Decoder New Deepseek Flash model matches OpenAI s GPT-5.6 Luna at roughly 60 percent lower cost 31 jul, 18:39
- Techmeme OpenAI says an internal version of Astra, its next big model, produced results for 10 problems in math, quantum complexity, and theoretical computer science (OpenAI) 1 aug, 16:35
- Wired The OpenAI and Anthropic AI Hacking Sprees Are a Messy New Legal Frontier betaalmuur 1 aug, 11:30
- Wired Chinese AI Researchers Are Finding Their Voice on X betaalmuur 31 jul, 20:14