L'IA, ce grand illusionniste
Ah, l'intelligence artificielle, cette merveille technologique qui promet de révolutionner le monde. Mais attendez, ne nous emballons pas trop vite. Derrière les promesses de rendre l'IA "utile, honnête et inoffensive", se cache une réalité beaucoup moins reluisante. Les entreprises comme Anthropic et OpenAI investissent des millions dans des mécanismes de "refus" pour empêcher leurs modèles de générer du contenu dangereux. Mais soyons honnêtes, ces systèmes sont aussi fiables qu'un parapluie en papier sous une pluie torrentielle.
Le "modèle du fromage suisse"
Prenons par exemple le "modèle du fromage suisse". Oui, c'est bien ce que vous pensez : plein de trous. Ces mécanismes de refus sont censés dire non à des requêtes dangereuses, comme aider à construire une bombe. Mais en réalité, ils sont aussi imparfaits que les humains qui les ont conçus. Et c'est là que le bât blesse.
Jailbreaking et autres réjouissances
Le "jailbreaking", cette technique qui permet de contourner les sécurités de l'IA, est un jeu d'enfant pour les hackers. Et ne parlons même pas des risques de censure gouvernementale. Imaginez un monde où l'IA décide de ce que vous pouvez ou ne pouvez pas dire. Effrayant, non ?
Les acteurs en jeu
- Zico Kolter : Membre du conseil d'OpenAI, il souligne la difficulté de tracer la ligne entre ce que l'IA doit refuser et ce qu'elle doit obéir.
- Joel Wester : Chercheur postdoctoral, il décrit les "manières sophistiquées de dire non" de l'IA.
- Jacob Mchangama : Directeur de The Future of Free Speech, il met en garde contre le pouvoir de censure des États via l'IA.
