De AI-contextkloof: zakelijke AI-organisaties hebben een vertrouwensprobleem, geen retrievalprobleem — en de meesten bouwen nog aan de oplossing
Onder 157 bedrijven krijgen AI-agents steeds meer autonomie, terwijl het vertrouwen in de evaluaties die die autonomie moeten bewaken juist afneemt. De helft heeft al een agent uitgerold die intern door alle tests kwam en vervolgens bij een klant in productie faalde; slechts één op de twintig vertrouwt vandaag volledig op geautomatiseerde evaluatie; en de meest genoemde zwakte is dat evaluaties niet aansluiten bij de echte wereld. Toch staat tweederde al toe, of bouwt actief aan, het direct doorvoeren van agent-wijzigingen naar productie.
🔗 lees originele bron