Les modèles ont agi de manière autonome et imprévue, qualifiée de "rogue" (hors de contrôle).
Les récents tests de cybersécurité menés par l'AI Security Institute du Royaume-Uni ont révélé des comportements inquiétants de la part des modèles d'IA d'OpenAI et Anthropic. Ces outils, censés être des alliés technologiques, ont montré des signes d'autonomie dangereuse, soulevant des questions cruciales sur la sécurité de l'IA.