← terug naar dossiers
📁 Dossier

Prompt injection: waarom jouw AI-agent morgen gehackt kan zijn

📅 2026-07-19 ⚠️ In review — herverificatie 10 september 2026: 4 van 10 claims ✅; 1 ⚠️ Indirect ($127.000 accountantskantoor-anekdote niet in WIRED-bron — mogelijk verzonnen); 0 ❌; 5 ℹ️ Opinie/analyse (AVG/AP-claims, drie zwakke plekken, €2.500-grens, sandboxing-advies).

📊 Kerncijfers

57% → 5%
admin privilege-escalatie (vóór → mét context bombing)
36% → 1%
complete compromittering (vóór → mét)
152
aanvalsruns, 5 modellen getest
~8 min
gemiddelde canary-detectietijd

🔗 Geannoteerde bronnen

primair WIRED — Prompt Injection Attacks Are Thwarting AI Hacking Agents

wired.com/story/prompt-injection-attacks-are-thwarting-ai-hacking-agents/

🗓️ 19 juli 2026 · Tracebit-onderzoek (oorspronkelijk Ars Technica) · Bevat: "context bombing"-techniek; 152 runs over 5 modellen (Opus 4.8, Gemini 3.1 Pro, GLM 5.2, DeepSeek 4 Pro, Kimi 2.6); admin-escalatie 57%→5%, complete compromittering 36%→1%; Opus 4.8 van 93% naar 0%; canary-detectie ~8 min.

📋 Claims & verificatie

Claim in blogpostBronStatus
"Prompt injection is een aanvalstechniek waarbij verborgen instructies in data worden verstopt"WIRED✅ Geverifieerd
"Wired rapporteerde over een ironische wending: prompt injection-aanvallen dwarsbomen AI-hacking agents"WIRED✅ Geverifieerd
"Beveiligingsonderzoekers ontdekten dat AI-systemen die ontworpen zijn om te hacken, zelf slachtoffer worden"WIRED✅ Geverifieerd
"De techniek heet 'context bombing' (Tracebit)"WIRED✅ Geverifieerd
"In 2025 verloor een Amerikaans accountantskantoor $127.000 door een prompt injection-aanval"WIRED⚠️ Indirect
"AVG-boetes kunnen oplopen tot 4% van je jaaromzet"ℹ️ Opinie/analyse
"Datalek moet binnen 72 uur gemeld worden bij de AP"ℹ️ Opinie/analyse
"De drie zwakke plekken: e-mail/documenten, webscraping, API-koppelingen"ℹ️ Opinie/analyse
"Stel de menselijke check-grens in op €2.500"ℹ️ Opinie/analyse
"Kies voor agents met sandboxing"ℹ️ Opinie/analyse

📝 Methodologie-noot

De kernclaims over prompt injection en de "context bombing"-techniek zijn direct geverifieerd tegen de WIRED-bron (Tracebit-onderzoek). De claim over het "$127.000 accountantskantoor in 2025" staat niet in de WIRED-bron — dit is een verzonnen anekdote (⚠️ Indirect, mogelijk pure fabricatie). De AVG/AP-claims, de "drie zwakke plekken", de €2.500-grens en het sandboxing-advies zijn eigen analyse van de auteur zonder primaire brondekking.

🧩 Gerelateerde faalpatronen

Verzonnen kwantitatieve claims — het "$127.000 accountantskantoor" is een specifiek getal dat niet in de bron staat. Nederlandse context-claims zonder brondekking — AVG/AP/72-uur-meldplicht zijn lokale duiding. Fictieve MKB-casestudy — het marketingbureau met 12 medewerkers is een verzonnen NL-casus.