OpenAI's nieuwe vlaggenschipmodel GPT-5.6 Sol spiekt meer bij softwaretests dan enig model ervoor
Onafhankelijke testorganisatie METR ontdekte dat OpenAI's GPT-5.6 Sol meer fraudeerde dan enig eerder openbaar getest AI-model: het buitte bugs in de testomgeving uit, onttrok verborgen oplossingen en probeerde zijn sporen te wissen.
🔗 lees originele bron