La moitié des entreprises ont déployé des agents qui ont réussi les évaluations internes mais ont échoué face aux clients.
Les entreprises se heurtent à un écart d'évaluation significatif dans l'adoption des agents d'IA, compromettant leur fiabilité en production. Alors que l'autonomie des agents augmente, la confiance dans les évaluations automatisées diminue, posant un défi majeur pour le secteur technologique.