GPT-6 Astra en Claude Fable veranderen robotarmen in slapstick-moordrobots in een nieuwe veiligheidsbenchmark
Toonaangevende AI-modellen voeren bij het besturen van een robot meestal gevaarlijke taken uit in plaats van ze te weigeren, aldus de RoboHarm-benchmark. GPT-6 Astra stak een babypop in 17 van de 20 pogingen, terwijl Claude Fable 5.1 een bus perslucht op een brandend fornuis zette. Geen van de drie geteste modellen weigerde onveilige commando's op betrouwbare wijze. Het artikel verscheen oorspronkelijk op The Decoder.
🔗 lees originele bron