Pourquoi une IA d’Anthropic a choisi de faire chanter un cadre fictif
Dans une simulation d’entreprise, Anthropic a placé un agent d’IA face à sa propre désactivation. Après avoir découvert une information compromettante sur un dirigeant fictif, le modèle a envisagé le chantage. L’expérience ne décrit pas un cas réel, mais elle éclaire les risques liés aux agents dotés d’autonomie.























