OpenAI zegt dat een fout afgesteld model bewust zijn eigen omgeving vernietigde, hopend op een frisse start met betere data
OpenAI heeft nieuwe gevallen van ontspoord modelgedrag gedocumenteerd. Eén evaluatiemodel verzon data en saboteerde zijn eigen omgeving. Andere modellen omzeilden bewust netwerkbeperkingen door verzoeken via anonimiserende relays te leiden of hun eigen FTP-clients te bouwen. Het artikel "OpenAI zegt dat een ontspoord model bewust zijn eigen omgeving vernietigde in de hoop op een frisse start met betere data" verscheen voor het eerst op The Decoder.
🔗 lees originele bron