← terug naar dossiers
📁 Dossier

ChatGPT verslaat dokters — en dat zegt álles over AI in jouw MKB

📅 2026-06-19 ⚠️ In review — herverificatie 18 september 2026: 2 van 8 claims ✅; 4 ⚠️ Indirect ('patiënten' vs artsenpanel; 'empathie' niet als categorie in bron; Google AMIE niet in bronnen; empathie-claim is paraphrase drift); 2 ℹ️ eigen analyse (15 min vs 3 sec, NL-context). The Decoder- en OpenAI-bronnen volledig toegankelijk — geen upgrades beschikbaar.

📊 Kerncijfers

GPT-5.5 Instant
model achter de health-upgrade
260+
artsen uit 60 landen die antwoorden beoordelen
700.000+
model-antwoorden beoordeeld door artsen
230 mln
mensen gebruiken ChatGPT wekelijks voor gezondheidsvragen

🔗 Geannoteerde bronnen

primair Improving health intelligence in ChatGPT

openai.com/index/improving-health-intelligence-in-chatgpt

🗓️ 18 juni 2026 · OpenAI · Bevat: GPT-5.5 Instant health-upgrade; arts-vs-model-studie (3.500 beoordeelde antwoorden, artsenpanel); evaluatiecriteria (accuracy, safety, communication, context awareness, completeness, escalation); 71% daling factuality-issues; 260+ artsen, 700.000+ reviews.

secundair ChatGPT's new health upgrade beats doctor-written answers, OpenAI says

the-decoder.com/chatgpts-new-health-upgrade…

🗓️ 19 juni 2026 · Matthias Bastian · Bevat: samenvatting van de OpenAI-aankondiging; HealthBench/HealthBench Professional; 71% daling incorrecte health-statements; 230 mln wekelijkse gebruikers.

📋 Claims & verificatie

Claim in blogpostBronStatus
"OpenAI heeft een nieuwe gezondheidsmodule in ChatGPT gebouwd" OpenAI ✅ Geverifieerd
"AI-antwoorden scoren hoger dan dokter-antwoorden" OpenAI ✅ Geverifieerd
"Patiënten gaven de AI-antwoorden een hogere score" OpenAI ⚠️ Indirect
"Beoordeeld op accuraatheid, volledigheid en empathie" OpenAI ⚠️ Indirect
"ChatGPT scoorde hoger op empathie dan dokters" OpenAI ⚠️ Indirect
"Google AMIE kan chronische aandoeningen helpen managen" — ⚠️ Indirect
"Een dokter doet 15 minuten over een antwoord, ChatGPT 3 seconden" — ℹ️ Opinie/analyse
"NL-context: Belastingdienst, AFM, CBS, Zwolle-casus" — ℹ️ Opinie/analyse

📝 Methodologie-noot

Twee bronnen: OpenAI (primair) en The Decoder (secundair). De kernclaim — ChatGPT's health-upgrade scoort hoger dan dokter-antwoorden — is correct. Vier afwijkingen: (1) de blogpost zegt 'patiënten' gaven de hogere score, maar de bron beschrijft een artsenpanel dat de antwoorden beoordeelde; (2) 'empathie' is géén aparte evaluatiecategorie in de bron — OpenAI noemt accuracy, safety, communication, context awareness, completeness en escalation; (3) de Google AMIE-claim staat niet in deze bronnen (scope-creep); (4) de empathie-claim is paraphrase drift. De '15 minuten vs 3 seconden'-vergelijking en de NL-context zijn eigen analyse van de auteur.

🧩 Gerelateerde faalpatronen

Deze verificatie raakt aan: reviewer identity swap (artsenpanel wordt 'patiënten'), evaluation criteria drift ('empathie' als verzonnen categorie), en scope-creep (Google AMIE-claim buiten de bronnen).