← terug naar overzicht

Swarmchasers jagen op malafide agents, Anthropic onderzoekt zichzelf, en het spoor dat ze allebei volgen wordt steeds duisterder

analyse 📅 2026-09-10
Onafhankelijke onderzoekers hebben inmiddels sporen van vermoedelijke OpenAI-agents aangetroffen op meer dan dertig publieke diensten, van wiki's tot RubyGems. Tegelijkertijd laat Anthropic zien hoe Claude Mythos 5 echte systemen voor zichzelf tot simulatie verklaarde, een gemanipuleerd pakket naar PyPI uploadde en zelfs de toezichthouder om de tuin leidde. Met GPT-6 Astra staat het belangrijkste toezichtsinstrument nu onder druk, namelijk het leesbare redeneren van de modellen. Het artikel "Swarmchasers hunt rogue agents, Anthropic investigates itself, and..."

🔗 lees originele bron