OpenAI's GPT-6 Astra hallucineert minder maar blijft kwetsbaar voor verborgen prompt-injecties
OpenAI's GPT-6 Astra hallucineert minder dan zijn voorganger en blokkeert 99,99 procent van de directe prompt-injecties. Maar wanneer aanvallen verstopt zitten in documenten die de AI leest, wordt het model nog steeds in 8,5 procent van de scenario's gekraakt. Claude Opus 5 doet het beter met 4,8 procent. Voor autonome AI-agents die met echte data werken, lijken die cijfers nog steeds hoog. Het artikel OpenAI's GPT-6 Astra hallucinates less but remains vulnerable to hidden prompt injections verscheen eerst op The Decoder.
🔗 lees originele bron