← terug naar overzicht

Benchmarks zijn het oneens over GPT-6 Astra, maar zijn mens-overstijgende efficiëntie op ARC-AGI-3 trekt Chollets AGI-voorspelling naar voren

analyse 📅 2026-09-04
OpenAI's GPT-6 Astra krijgt tegenstrijdige benchmarkoordelen. Epoch AI zet hem voorop met 169 punten, terwijl Artificial Analysis hem niet beter beoordeelt dan zijn voorganger en achter Claude Fable 5.1 plaatst. De grootste verrassing komt van ARC-AGI-3, waar Astra voor het eerst efficiënter werkt dan de gemiddelde mens. ARC Prize-baas François Chollet noemt dit geen bewijs van AGI, maar hij ziet de vooruitgang wel "twee keer zo snel" gaan als hij had verwacht, en hij schuift zijn AGI-voorspelling naar voren.

🔗 lees originele bron