← terug naar dossiers
📁 Dossier

ChatGPT deed PhD-onderzoek in twee uur — dit betekent het voor jouw MKB-innovatie

📅 2026-07-28 ✅ Geverifieerd — 10 van 10 claims ✅

📊 Kerncijfers

<2 uur
Tijd die ChatGPT 5.5 Pro nodig had voor PhD-niveau wiskunde
17 min
Denktijd voor verbetering van Nathanson's exponentiële grens naar kwadratisch
$1.100
Kosten per volledig AI-gegenereerd research paper (FARS)
1/2,5 uur
Snelheid van Analemma's FARS: 166 papers in ~417 uur

🔗 Geannoteerde bronnen

primair The Decoder: Fields Medalist says ChatGPT 5.5 Pro delivered PhD-level math research

the-decoder.com/fields-medalist-says-chatgpt-5-5-pro...

🗓️ 9 mei 2026 · Matthias Bastian · Fields Medalist Timothy Gowers (Collège de France, Trinity College Cambridge) rapporteert dat ChatGPT 5.5 Pro in ~2 uur twee PhD-niveau problemen oploste: (1) Nathanson's exponentiële grens → kwadratisch (beste mogelijk, 17 min denktijd), (2) Rajagopal's exponentiële → polynomiale grens (31 min). Preprints beschikbaar op Google Drive. Citaat van Gowers: "The lower bound for contributing to mathematics will now be to prove something that LLMs can't prove."

primair The Conversation: The AI scientist — now academic papers can be fully automated

theconversation.com/the-ai-scientist-now-academic-papers...

🗓️ 13 mei 2026 · Prof. Sorin Krammer (University of Southampton) · Overzicht van autonome AI-research: Sakana AI's "The AI Scientist" (geaccepteerd op ICLR 2025 workshop, Nature-artikel maart 2026); Analemma's FARS (166 papers in ~417 uur, $1.100/paper); Google's PaperOrchestra (logboek → manuscript). Bespreekt implicaties voor academische publicatie, auteursrecht (US: geen copyright op AI-werk), en creatieve industrie (AI-podcast #1 UK, AI-band 1M+ Spotify luisteraars).

📋 Claims & verificatie

Claim in blogpostBronStatus
"ChatGPT 5.5 Pro [leverde] wiskundig onderzoek op PhD-niveau af" The Decoder (Gowers) ✅ Geverifieerd
"Twee uur. Langer duurde het niet" The Decoder ✅ Geverifieerd
"Een Fields Medal-winnaar — de Nobelprijs van de wiskunde — bevestigde het" The Decoder (Timothy Gowers) ✅ Geverifieerd
"Geen menselijke sturing. Geen correcties. Gewoon: prompt erin, resultaat eruit." The Decoder (Gowers) ✅ Geverifieerd
"De AI-wetenschapper formuleert hypotheses, toetst ze tegen data, trekt conclusies en schrijft het paper" The Conversation (Sakana AI) ✅ Geverifieerd
"Sakana AI's 'The AI Scientist' [is] 'the first comprehensive system for fully automatic scientific discovery'" The Conversation ✅ Geverifieerd
"Een AI Scientist paper [werd] geaccepteerd op een workshop van ICLR 2025" The Conversation ✅ Geverifieerd
"Analemma's Fully Automated Research System [produceerde] 166 complete machine-learning research papers in ~417 uur" The Conversation ✅ Geverifieerd
"ChatGPT 5.5 Pro kost ongeveer $200 per maand voor een teamabonnement" The Decoder (Gowers) ✅ Geverifieerd
"GPT-5.2 Pro [loste] Erdős-probleem #728 'more or less autonomously'" The Decoder ✅ Geverifieerd

📐 Methodologie-noot

Alle 10 feitelijke claims zijn rechtstreeks geverifieerd tegen de twee primaire bronnen. De blogpost baseert zich vrijwel volledig op The Decoder (Gowers-artikel) en The Conversation (Krammer-overzicht) — beide bronnen waren volledig toegankelijk via web_extract. De MKB-gerichte duiding (prijsvergelijkingen, actiepunten, de "AI-hybride" aanpak) is eigen analyse van de auteur en als zodanig niet in de claims-tabel opgenomen. De schatting van $5 per API-analyse is een eigen extrapolatie — niet geverifieerd maar ook niet als claim opgenomen omdat het nadrukkelijk een schatting ("misschien") betreft. Het dossier bevat 10 claims waarvan 10 (100%) ✅ Geverifieerd.

🧩 Gerelateerde faalpatronen

Blind vertrouwen in AI-uitspraken (score: 8/10) — AI kan briljante analyses produceren die wiskundig correct zijn maar praktisch onbruikbaar. De blogpost waarschuwt hiervoor met het magazijnlogistiek-voorbeeld.

Organisatie als bottleneck (score: 8/10) — De grootste uitdaging is niet de AI-technologie zelf, maar hoe organisaties deze integreren in bestaande processen. De "human-in-the-loop" aanpak die de blogpost aanbeveelt adresseert dit direct.

AI-cognitieve erosie (score: 7/10) — Als AI autonoom onderzoek doet, bestaat het risico dat mensen de vaardigheid verliezen om output kritisch te beoordelen. Gowers zelf waarschuwt dat "very good coders are better at vibe coding than not such good coders."

AI-aansprakelijkheidsvacuüm (score: 9/10) — US-rechtbanken hebben geoordeeld dat AI-gegenereerd werk geen copyright kan krijgen. Dit creëert een vacuüm: AI produceert op industriële schaal, maar niemand kan de output juridisch bezitten.