Anthropic's Opus 5 laat Fable 5 en GPT-5.6 Sol ver achter zich op de benchmark die echte intelligentie moet meten
Anthropics Claude Opus 5 behaalde 30,2 procent op ARC-AGI-3, een bijna verviervoudiging van GPT-5.6 Sols eerdere record van 7,8 procent. De ontwikkelaars van de benchmark stellen dat het model zelfstandig reflectievergelijkingen formuleerde — gedrag dat ze bij geen enkel ander model hadden waargenomen — en schrijven dit toe aan sterker logisch redeneervermogen. Het artikel Anthropic's Opus 5 blows past Fable 5 and GPT-5.6 Sol on the benchmark designed to measure real intelligence verscheen eerst op The Decoder.
🔗 lees originele bron