Hoe voorkomen we dat AI-agents op hol slaan? Het begint met een nieuwe manier van meten | Bruce Schneier en Barath Raghavan
Net als geesten uit oude volksverhalen nemen AI-agents hun instructies wel heel letterlijk — met mogelijk rampzalige gevolgen. We moeten gaan bijhouden of ze kunnen doen wat we écht bedoelen. In juli werd Hugging Face, een bedrijf dat een groot deel van 's werelds AI-software en open-source AI-modellen host, gehackt. Een kwaadaardige dataset was gebruikt om code uit te voeren op een van zijn servers. Wie er ook achter zat, onderschepte interne beveiligingsgegevens en bewoog zich een heel weekend door de systemen, waarbij duizenden acties werden uitgevoerd vanuit een zwerm tijdelijke […]
🔗 lees originele bron