← terug naar dossiers
📁 Dossier

Anthropic slaat terug: Opus 5 verslaat OpenAI's beste modellen op de lastigste benchmark

📅 2026-07-27 ⚠️ In review — herverificatie 27 juli 2026: 5 van 9 claims ✅; 3 ⚠️ Indirect (Simon Willison-parafrase, niet-OpenAI-claim ambigu, Cursor-agent swarm niet in bronnen); 1 ℹ️ Opinie/analyse

📊 Kerncijfers

30,2%
ARC-AGI-3 score Opus 5
beter dan vorig record (7,8%)
$5/$25
prijs per 1M input/output tokens
50%
goedkoper dan Fable 5

🔗 Geannoteerde bronnen

primair The Decoder: Anthropic's Opus 5 blows past Fable 5 and GPT-5.6 Sol

https://the-decoder.com/anthropics-opus-5-blows-past-fable-5-and-gpt-5-6-sol-on-...

🗓️ 2026-07-26

primair The Verge: Anthropic releases Opus 5

https://www.theverge.com/ai-artificial-intelligence/970105/claude-opus-5-announc...

🗓️ 2026-07-27

secundair Simon Willison: Introducing Claude Opus 5

https://simonwillison.net/2026/Jul/24/introducing-claude-opus-5/...

🗓️ 2026-07-24

📋 Claims & verificatie

Claim in blogpostBronStatus
Opus 5 blaast niet alleen GPT-5.6 Sol voorbij The Decoder ✅ Geverifieerd
komt ook gevaarlijk dicht bij Fable 5 The Verge ✅ Geverifieerd
Simon Willison noemde het "een indrukwekkende sprong" Simon Willison ⚠️ Indirect
Opus 5 presteert 'close to Fable 5's capabilities', terwijl het aanzienlijk goedkoper is The Verge ✅ Geverifieerd
Voor het eerst heeft een niet-OpenAI-model de absolute top bereikt The Decoder ⚠️ Indirect
Opus 5 laat op de benchmark die 'echte intelligentie' meet zowel Fable 5 als GPT-5.6 Sol achter zich The Decoder ✅ Geverifieerd
Opus 5 is gewoon beschikbaar via de Claude API en het chat.abonnement The Verge ✅ Geverifieerd
Cursor's 'agent swarm' — goedkopere modellen doen meeste werk, duur topmodel doet planning niet in Opus 5-bronnen ⚠️ Indirect
Je krijgt topniveau AI zonder dat je een inkoopafdeling nodig hebt eigen analyse ℹ️ Opinie/analyse

📝 Methodologie-noot

De blogpost gebruikt 3 bronnen (The Decoder, The Verge, Simon Willison) die allemaal volledig toegankelijk waren via web_extract. De Simon Willison-parafrase is ⚠️ Indirect omdat Willison de woorden "indrukwekkende sprong" niet letterlijk gebruikt — hij zegt "the buzz is positive" en "sounds promising". De Cursor-agent swarm claim staat niet in de Opus 5-bronnen — dit is een apart The Decoder-artikel. De claim "voor het eerst heeft een niet-OpenAI-model de absolute top bereikt" is ambigu: Kimi K3 en andere modellen hebben eerder ook topposities bereikt op andere benchmarks.

🧩 Gerelateerde faalpatronen

  • Paraphrase drift — de blogpost parafraseert Simon Willison's woorden met meer enthousiasme dan de bron rechtvaardigt
  • Scope-creep — de Cursor-agent swarm claim komt uit een ander artikel, niet uit de Opus 5-bronnen
  • Attribution drift — "niet-OpenAI-model" claim is te absoluut; andere modellen hebben eerder topposities bereikt