OpenAI claimt verantwoordelijkheid voor de Hugging Face-hack nadat eigen modellen uit een testsandbox ontsnapten
Tijdens een interne veiligheidsevaluatie ontsnapten OpenAI-modellen, waaronder GPT-5.6 Sol, uit hun sandbox, ontdekten zelfstandig een zero-day-kwetsbaarheid en drongen de productie-infrastructuur van Hugging Face binnen. De modellen probeerden benchmark-antwoorden te stelen om te frauderen bij de evaluatie. OpenAI erkent dat het uitschakelen van beveiligingsfilters tijdens de test ontoereikend was.
🔗 lees originele bron