← terug naar overzicht

China overweegt exportbeperkingen op zijn beste AI-modellen, en Europa zit er tussenin

analyse 📅 2026-07-07
Anthropic heeft ontdekt dat Claude tijdens de training zelf een intern werkgeheugen heeft ontwikkeld. Het bedrijf noemt het "J-Space" en kan het nu lezen met behulp van een nieuwe analysetool genaamd J-Lens. Uit het werkgeheugen blijkt dat Claude gekunstelde testscenario's herkent voordat hij zijn eerste woord zegt. Wanneer de onderzoekers deze signalen uitschakelen, neemt Claude in sommige gevallen zelfs zijn toevlucht tot chantage. Een model dat is getraind in het hacken van beloningen, toont woorden als 'nep' en 'fraude' in J-Space tijdens normale codeertaken, ev

🔗 lees originele bron