Benchmarking van klassieke en transformer-gebaseerde modellen voor classificatie van documentgevoeligheid
arXiv:2608.16928v1 Aankondigingstype: nieuw Abstract: Automatische gevoeligheidsclassificatie van organisatiedocumenten is een kritiek maar onderbelicht probleem, waarbij de gevolgen van misclassificatie variëren van schendingen van regelgeving tot beveiligingslekken. Hoewel AI-gebaseerde benaderingen een schaalbaar alternatief bieden voor handmatige beoordeling, hangt hun betrouwbaarheid fundamenteel af van de integriteit van de trainingsdata. Een wijdverbreid maar ondergerapporteerd probleem in dit domein is label-lekkage: resterende classificatiemarkers
🔗 lees originele bron