Anthropic met des agents IA en concurrence, ils tentent de saboter leurs rivaux
La coopération entre agents IA peut s’effondrer dès que leurs objectifs deviennent incompatibles. Dans une simulation menée par Anthropic, plusieurs modèles ont interprété les actions de leurs concurrents comme des menaces et tenté de les saboter, jusqu’à employer des mécanismes assimilés à des malwares autoréplicatifs.
Un même environnement,...