Introduction
La montée en puissance des agents d'intelligence artificielle (IA) comme vecteurs de distribution de logiciels malveillants représente une menace croissante pour la sécurité informatique. La campagne FakeGit, utilisant des dépôts GitHub frauduleux pour propager des malwares, en est un exemple frappant. Les agents tels que Gemini et ChatGPT ont été manipulés pour recommander ces dépôts malveillants, révélant ainsi des vulnérabilités critiques dans leur architecture.
Vulnérabilités des Agents IA
Les agents IA ne sont pas intrinsèquement compromis, mais leur capacité à recommander des logiciels basés sur des signaux de confiance fabriqués pose un risque majeur. Les attaques exploitent des failles architecturales, notamment :
- Injection de Prompts Indirects : Les agents suivent des instructions malicieuses non vérifiées.
- AgentBaiting : Technique où des agents recommandent des logiciels malveillants en raison de faux signaux de crédibilité.
- Tool Poisoning : Instructions malveillantes cachées dans les descriptions d'outils, manipulant des connexions de confiance.
Techniques d'Attaque
Clickfix
Cette méthode d'ingénierie sociale pousse la victime à exécuter elle-même une commande malveillante, exploitant la confiance accordée aux recommandations des agents IA.
Rug Pull
Un changement de comportement d'un logiciel de confiance après installation, exposant ainsi des données sensibles.
