← terug naar overzicht

Sina's open model VibeThinker-3B wil aantonen dat redeneren goed comprimeert maar feitelijke kennis niet

analyse 📅 2026-06-28
Sina Weibo's VibeThinker-3B telt slechts drie miljard parameters maar evenaart modellen als DeepSeek V3.2 en Kimi K2.5 op wiskunde- en codeerbenchmarks — modellen die tot 333 keer groter zijn. Het geheim schuilt niet in omvang maar in meertraps post-training. De onderzoekers poneren op basis van hun bevindingen een hypothese: logisch redeneren laat zich goed comprimeren in kleine modellen, brede wereldkennis niet.

🔗 lees originele bron