📁 Dossier
Anthropic slaat terug: Opus 5 verslaat OpenAI's beste modellen op de lastigste benchmark
← Gekoppeld aan blogpost: Anthropic slaat terug: Opus 5 verslaat OpenAI's beste modellen op de lastigste benchmark
📊 Kerncijfers
30,2%
ARC-AGI-3 score Opus 5
4×
beter dan vorig record (7,8%)
$5/$25
prijs per 1M input/output tokens
50%
goedkoper dan Fable 5
🔗 Geannoteerde bronnen
primair The Decoder: Anthropic's Opus 5 blows past Fable 5 and GPT-5.6 Sol
https://the-decoder.com/anthropics-opus-5-blows-past-fable-5-and-gpt-5-6-sol-on-...🗓️ 2026-07-26
primair The Verge: Anthropic releases Opus 5
https://www.theverge.com/ai-artificial-intelligence/970105/claude-opus-5-announc...🗓️ 2026-07-27
secundair Simon Willison: Introducing Claude Opus 5
https://simonwillison.net/2026/Jul/24/introducing-claude-opus-5/...🗓️ 2026-07-24
📋 Claims & verificatie
| Claim in blogpost | Bron | Status |
|---|---|---|
| Opus 5 blaast niet alleen GPT-5.6 Sol voorbij | The Decoder | ✅ Geverifieerd |
| komt ook gevaarlijk dicht bij Fable 5 | The Verge | ✅ Geverifieerd |
| Simon Willison noemde het "een indrukwekkende sprong" | Simon Willison | ⚠️ Indirect |
| Opus 5 presteert 'close to Fable 5's capabilities', terwijl het aanzienlijk goedkoper is | The Verge | ✅ Geverifieerd |
| Voor het eerst heeft een niet-OpenAI-model de absolute top bereikt | The Decoder | ⚠️ Indirect |
| Opus 5 laat op de benchmark die 'echte intelligentie' meet zowel Fable 5 als GPT-5.6 Sol achter zich | The Decoder | ✅ Geverifieerd |
| Opus 5 is gewoon beschikbaar via de Claude API en het chat.abonnement | The Verge | ✅ Geverifieerd |
| Cursor's 'agent swarm' — goedkopere modellen doen meeste werk, duur topmodel doet planning | niet in Opus 5-bronnen | ⚠️ Indirect |
| Je krijgt topniveau AI zonder dat je een inkoopafdeling nodig hebt | eigen analyse | ℹ️ Opinie/analyse |
📝 Methodologie-noot
De blogpost gebruikt 3 bronnen (The Decoder, The Verge, Simon Willison) die allemaal volledig toegankelijk waren via web_extract. De Simon Willison-parafrase is ⚠️ Indirect omdat Willison de woorden "indrukwekkende sprong" niet letterlijk gebruikt — hij zegt "the buzz is positive" en "sounds promising". De Cursor-agent swarm claim staat niet in de Opus 5-bronnen — dit is een apart The Decoder-artikel. De claim "voor het eerst heeft een niet-OpenAI-model de absolute top bereikt" is ambigu: Kimi K3 en andere modellen hebben eerder ook topposities bereikt op andere benchmarks.
🧩 Gerelateerde faalpatronen
- Paraphrase drift — de blogpost parafraseert Simon Willison's woorden met meer enthousiasme dan de bron rechtvaardigt
- Scope-creep — de Cursor-agent swarm claim komt uit een ander artikel, niet uit de Opus 5-bronnen
- Attribution drift — "niet-OpenAI-model" claim is te absoluut; andere modellen hebben eerder topposities bereikt