← terug naar overzicht

Een AI-model programmeerde 19 dagen onafgebroken aan één MirrorCode-taak — kosten: $2.600

analyse 📅 2026-06-26
Epoch AI's nieuwe MirrorCode-benchmark test of AI-modellen complete programma's kunnen nabouwen zonder toegang tot de originele code — Claude Opus 4.7 voert de ranglijst aan met 56 procent en bouwde een toolkit van 16.000 regels na in slechts 14 uur, maar elk getest model faalt nog op de meest complexe taken

🔗 lees originele bron