← terug naar dossiers
📁 Dossier

GPT-5.6 lost een 50 jaar oud wiskundeprobleem op — dit betekent het voor jouw bedrijf

📅 2026-07-12 ⚠️ In review — herverificatie 14 juli 2026: 6 van 8 claims ✅; 1 ⚠️ Indirect (Sol Ultra is een reasoning setting, geen apart model); 0 ❌; 1 ℹ️ eigen analyse

📊 Kerncijfers

~50 jaar
Openstaand wiskundeprobleem
<1 uur
Tijd tot oplossing
64
Parallelle subagents
3 maanden
GPT-5.5 → GPT-5.6

🔗 Geannoteerde bronnen

primair OpenAI Blog — GPT-5.6 aankondiging

openai.com/index/gpt-5-6

🗓️ 9 juli 2026 · OpenAI · Bevat: volledige modelspecificaties, benchmarks, pricing ($1-$30 per 1M tokens), reasoning effort levels (max/ultra), multi-agent API. Géén vermelding van het wiskundeprobleem — de oplossing werd extern ontdekt.

primair The Decoder — Matthias Bastian

the-decoder.com/openais-gpt-5-6-sol-ultra...

🗓️ 11 juli 2026 · Matthias Bastian · Bevat: volledige beschrijving van de oplossing (Cycle Double Cover Conjecture), 64 subagents, Thomas Bloom's assessment, prompt-details, kritiek op gebrek aan citaties.

context Simon Willison — GPT-5.6 analyse

simonwillison.net/2026/Jul/9/gpt-5-6/

🗓️ 9 juli 2026 · Simon Willison · Bevat: pricing-tabel (Luna $1/$6, Terra $2.50/$15, Sol $5/$30), benchmark-vergelijkingen met Claude Fable 5, SWE-Bench Pro kritiek, API-features (Programmatic Tool Calling, multi-agent).

📋 Claims & verificatie

Claim in blogpostBronStatus
"GPT-5.5 werd uitgebracht in maart. GPT-5.6 is er nu, juli. Drie maanden." OpenAI Blog (9 juli 2026) ✅ Geverifieerd
"64 subagents werkten parallel" The Decoder (11 juli 2026) ✅ Geverifieerd
"Cycle Double Cover Conjecture — 50 jaar open" The Decoder (11 juli 2026) ✅ Geverifieerd
"Thomas Bloom (University of Manchester) beoordeelde het bewijs" The Decoder (11 juli 2026) ✅ Geverifieerd
"OpenAI claimde niet 'we hebben een wiskundeprobleem opgelost' in hun aankondiging" OpenAI Blog (9 juli 2026) ✅ Geverifieerd
"Een externe onderzoeker dacht: laat ik het eens vragen. En kreeg antwoord." The Decoder (11 juli 2026) ✅ Geverifieerd
"De variant die het wiskundeprobleem oploste — Sol Ultra — bestaat pas een week" OpenAI Blog (9 juli 2026) ⚠️ Indirect
"GPT-5.6 Sol Ultra deed wat DeepMind's AlphaFold deed voor eiwitvouwing in 2020" The Decoder (11 juli 2026) ℹ️ Opinie/analyse

📝 Methodologie-noot

De kerncorrectie uit de vorige verificatie blijft gehandhaafd: "Sol Ultra" is een reasoning effort setting binnen GPT-5.6 Sol, geen apart model dat later is uitgebracht. De OpenAI Blog (9 juli) beschrijft "ultra" als onderdeel van de launch: "A new ultra setting coordinates multiple agents in parallel for the hardest tasks." De blogpost framet dit als een aparte variant die "pas een week bestaat" — maar ultra was beschikbaar vanaf dag 1 van de GPT-5.6 release. De AlphaFold-vergelijking is eigen analyse van de auteur; The Decoder vermeldt wel een vergelijking met OpenAI's eerdere unit distance conjecture-oplossing, maar niet met AlphaFold.

🧩 Gerelateerde faalpatronen

  • Model variant vs. setting confusion — De blogpost-pipeline verwart een configuratie-setting (ultra reasoning effort) met een apart model. Dit is exact hetzelfde patroon als in de eerste verificatie: de bronnen beschrijven "ultra" als een setting, niet als een aparte modelvariant.
  • Paraphrase drift — De blogpost versterkt het narratief door "ultra" te framen als een nieuwe, aparte release, terwijl de bronnen het beschrijven als een ingebouwde functionaliteit.
  • Numerical extrapolation by author — De MKB-doorvertaling (installatiebedrijf, 8 uur, €15.000 consultant) is volledig eigen analyse zonder bronbasis.