← terug naar overzicht

Niet iedereen is ervan overtuigd dat de voorgestelde ontwikkelingspauze van Big AI echt om veiligheid draait

analyse 📅 2026-09-15
7. Voor lokale large-language-modelagenten is actieve context een schaars goed: geheugencapaciteit, prefill-latentie, cachegroei en servicedoelstellingen beperken allemaal hoeveel invoer-tokens elke aanroep zich kan veroorloven. We presenteren BudgetBench, een actief-budgetprotocol en referentie-harnas dat het invoer-tokenbudget per aanroep behandelt als de onafhankelijke variabele bij het vergelijken van geheugenstrategieën. Met model, taak, sampler en decodering constant gehouden, wordt het budget over een reeks waarden gevarieerd.

🔗 lees originele bron