← terug naar overzicht

Benchmarking van klassieke en transformer-gebaseerde modellen voor classificatie van documentgevoeligheid

onderzoek 📅 2026-08-19
arXiv:2608.16928v1 Aankondigingstype: nieuw Abstract: Automatische gevoeligheidsclassificatie van organisatiedocumenten is een kritiek maar onderbelicht probleem, waarbij de gevolgen van misclassificatie variëren van schendingen van regelgeving tot beveiligingslekken. Hoewel AI-gebaseerde benaderingen een schaalbaar alternatief bieden voor handmatige beoordeling, hangt hun betrouwbaarheid fundamenteel af van de integriteit van de trainingsdata. Een wijdverbreid maar ondergerapporteerd probleem in dit domein is label-lekkage: resterende classificatiemarkers

🔗 lees originele bron