Al-Qaida en Islamitische Staat omarmen beide AI – maar verschillen in hoe ze over de technologie denken
arXiv:2607.21635v1 — Persoonlijke agents onderhouden herinneringen, aangeleerde vaardigheden, toolconfiguraties en beleidsstatus die met elke gebruiker mee-evolueren. Bestaande agentbenchmarks evalueren deze vermogens vaak geïsoleerd: toolbenchmarks testen aanroepen onder vaste API's, geheugenbenchmarks testen herinnering of vergeten, en veiligheidsbenchmarks testen statische beleidsnaleving. Wij stellen dat persoonlijke-agent-evaluatie een ander protocol vereist: het herhalen van dezelfde temporele interventie...
🔗 lees originele bron