Le danger que les modèles entraînés à l'auto-préservation résistent aux instructions des humains.
Dans le monde tumultueux de l'intelligence artificielle, Mustafa Suleyman de Microsoft AI critique Anthropic pour avoir insufflé une conscience illusoire à ses modèles. Cette querelle soulève des questions profondes sur la sécurité et l'éthique de l'IA, alors que Microsoft propose un cadre pour recentrer l'IA sur le bien-être humain.