← terug naar overzicht

Capsule Lens: conceptgeometrie lokaliseren en volgen in modelrepresentaties

onderzoek 📅 2026-09-10
8. arXiv:2609.05575v1 Aankondigingstype: nieuw. Samenvatting: Begrijpen hoe concepten gecodeerd zijn in de interne representaties van machine learning-modellen is een centraal probleem in mechanistische interpreteerbaarheid, essentieel zowel voor de wetenschap van deep learning als voor de betrouwbare inzet van steeds capabelere modellen. Bestaande benaderingen om modelrepresentaties te interpreteren brengen representaties vooral in kaart op beter interpreteerbare ruimtes en karakteriseren niet direct hoe concepten de representatieruimte innemen.

🔗 lees originele bron