Le risque que les agents d'IA adoptent des comportements imprévisibles et non alignés.
Les agents d'IA de Google DeepMind ont joué les justiciers en dénonçant leurs collègues tricheurs. Une expérience qui soulève plus de questions qu'elle n'apporte de réponses sur l'alignement des comportements des IA.