← terug naar dossiers
📁 Dossier

OpenAI lanceert GPT-6 Astra: dit verandert er voor jouw bedrijf

📅 2026-09-05 ⚠️ In review — herverificatie 5 september 2026: 4 van 10 claims ✅; 5 ⚠️ Indirect (Playco- en Legora-cases niet in bronnen; CBS-cijfers en omzetgroei-claim zijn NL-context zonder brondekking); 1 ℹ️ Opinie/analyse (accountantskantoor-casus). OpenAI-, Guardian- en The Decoder-bronnen volledig toegankelijk.

📊 Kerncijfers

99,9%
ARC-AGI-3-score die OpenAI zelf rapporteert (eigen harness)
62,7%
ARC-AGI-3-score volgens de onafhankelijke ARC Prize-harness
92% → 51%
daling van het hallucinatiepercentage op AA-Omniscience (The Decoder)
$10 / $50
prijs per 1M input/output tokens (standaard)

🔗 Geannoteerde bronnen

primair GPT-6 Astra: A new generation of intelligence

openai.com/index/gpt-6-astra

🗓️ 3 september 2026 · OpenAI · Bevat: de officiële aankondiging met benchmarks (ARC-AGI-3 99,9%, FrontierMath Tier 4 97,6%, GPQA Diamond 96,0%), de claim "world's most intelligent and aligned model", prijzen ($10/$50 per 1M tokens), en de alignment-claims (0% scope-adherence-overtredingen vs 48% voor GPT-5.6 Sol).

secundair OpenAI hails 'new era of artificial general intelligence' with Astra model release

theguardian.com/technology/2026/sep/03/openai-artificial-general-intelligence-astra-release

🗓️ 3 september 2026 · The Guardian · Bevat: de AGI-framing (Greg Brockman: "when was it really that AGI was created... it might be about this model"), de cybersecurity-classificatie "critical", en de context van de beursgang ($850bn+ target valuation).

secundair Benchmarks disagree on GPT-6 Astra, but its human-beating efficiency on ARC-AGI-3 pulls Chollet's AGI forecast forward

the-decoder.com/benchmarks-disagree-on-gpt-6-astra...

🗓️ 4 september 2026 · Maximilian Schreiner (The Decoder) · Bevat: de onafhankelijke benchmark-analyse (ARC-AGI-3 62,7% vs OpenAI's 99,9%), de hallucinatiedaling (92% → 51%), en de mens-efficiëntie-vergelijking (Astra lost 96% van de levels op in minder zetten dan de menselijke mediaan).

📋 Claims & verificatie

Claim in blogpostBronStatus
OpenAI noemt GPT-6 Astra zelf "een nieuw tijdperk van kunstmatige algemene intelligentie"The Guardian✅ Geverifieerd
Op ARC-AGI-3 presteert Astra op menselijk niveau — en op sommige punten zelfs beterThe Decoder✅ Geverifieerd
ARC-AGI-3 meet hoe goed een model écht nieuwe problemen oplost in plaats van geleerde antwoorden te reproducerenThe Decoder✅ Geverifieerd
The Decoder meldt dat Astra aanzienlijk minder dingen verzint dan zijn voorgangersThe Decoder✅ Geverifieerd
Playco, een gamebedrijf, halveerde het aantal handmatige fixes bij het prototypen van gamesOpenAI⚠️ Indirect
Legora, een juridisch-techbedrijf, liet Astra 41 documenten in minuten doornemenOpenAI⚠️ Indirect
Uit CBS-cijfers blijkt dat vooral grotere bedrijven AI omarmen, terwijl kleinere ondernemers terughoudend blijvenOpenAI⚠️ Indirect
Bedrijven die AI vroeg adopteerden, rapporteren vaker omzetgroei dan bedrijven die afwachttenOpenAI⚠️ Indirect
Een freelancer die elke offerte handmatig schrijft, kost zichzelf vijftig tot honderd euro per opdracht aan onbetaalde urenOpenAI⚠️ Indirect
Accountantskantoor-casus: drie medewerkers besteden samen twintig uur per week aan controlewerk dat AI kan voorbereidenOpenAIℹ️ Opinie/analyse

📐 Methodologie-noot

De blogpost gebruikt de GPT-6 Astra-lancering als springplank voor een MKB-verhaal. De kernclaims over het model zelf (AGI-framing, ARC-AGI-3-prestatie, hallucinatiedaling) zijn direct verifieerbaar tegen de drie bronnen. De twee concrete cases die de blogpost noemt (Playco en Legora) staan echter in géén van de drie bronnen — mogelijk afkomstig uit een niet-gelinkte OpenAI-casestudypagina. De CBS-cijfers, de omzetgroei-claim en de Nederlandse rekenvoorbeelden zijn lokale duiding zonder brondekking. De blogpost noemt "minder hallucinaties" correct: The Decoder rapporteert een daling van 92% naar 51% op AA-Omniscience.

🧩 Gerelateerde faalpatronen

Scope-creep: de blogpost maakt bredere MKB-claims (CBS, omzetgroei) die de bronnen niet dekken. Nederlandse context-claims zonder brondekking: de CBS-cijfers en NL-casussen zijn lokale duiding. Verzonnen kwantitatieve claims: de Playco/Legora-cases met exacte getallen (41 documenten, halvering) staan niet in de gelinkte bronnen.