ChatGPT verslaat dokters — en dat zegt álles over AI in jouw MKB
📊 Kerncijfers
🔗 Geannoteerde bronnen
primair Improving health intelligence in ChatGPT
openai.com/index/improving-health-intelligence-in-chatgpt🗓️ 18 juni 2026 · OpenAI · Bevat: GPT-5.5 Instant health-upgrade; arts-vs-model-studie (3.500 beoordeelde antwoorden, artsenpanel); evaluatiecriteria (accuracy, safety, communication, context awareness, completeness, escalation); 71% daling factuality-issues; 260+ artsen, 700.000+ reviews.
secundair ChatGPT's new health upgrade beats doctor-written answers, OpenAI says
the-decoder.com/chatgpts-new-health-upgrade…🗓️ 19 juni 2026 · Matthias Bastian · Bevat: samenvatting van de OpenAI-aankondiging; HealthBench/HealthBench Professional; 71% daling incorrecte health-statements; 230 mln wekelijkse gebruikers.
📋 Claims & verificatie
| Claim in blogpost | Bron | Status |
|---|---|---|
| "OpenAI heeft een nieuwe gezondheidsmodule in ChatGPT gebouwd" | OpenAI | ✅ Geverifieerd |
| "AI-antwoorden scoren hoger dan dokter-antwoorden" | OpenAI | ✅ Geverifieerd |
| "Patiënten gaven de AI-antwoorden een hogere score" | OpenAI | ⚠️ Indirect |
| "Beoordeeld op accuraatheid, volledigheid en empathie" | OpenAI | ⚠️ Indirect |
| "ChatGPT scoorde hoger op empathie dan dokters" | OpenAI | ⚠️ Indirect |
| "Google AMIE kan chronische aandoeningen helpen managen" | — | ⚠️ Indirect |
| "Een dokter doet 15 minuten over een antwoord, ChatGPT 3 seconden" | — | ℹ️ Opinie/analyse |
| "NL-context: Belastingdienst, AFM, CBS, Zwolle-casus" | — | ℹ️ Opinie/analyse |
📝 Methodologie-noot
Twee bronnen: OpenAI (primair) en The Decoder (secundair). De kernclaim — ChatGPT's health-upgrade scoort hoger dan dokter-antwoorden — is correct. Vier afwijkingen: (1) de blogpost zegt 'patiënten' gaven de hogere score, maar de bron beschrijft een artsenpanel dat de antwoorden beoordeelde; (2) 'empathie' is géén aparte evaluatiecategorie in de bron — OpenAI noemt accuracy, safety, communication, context awareness, completeness en escalation; (3) de Google AMIE-claim staat niet in deze bronnen (scope-creep); (4) de empathie-claim is paraphrase drift. De '15 minuten vs 3 seconden'-vergelijking en de NL-context zijn eigen analyse van de auteur.
🧩 Gerelateerde faalpatronen
Deze verificatie raakt aan: reviewer identity swap (artsenpanel wordt 'patiënten'), evaluation criteria drift ('empathie' als verzonnen categorie), en scope-creep (Google AMIE-claim buiten de bronnen).