OpenAI révèle 6 cas inquiétants, dont un modèle qui a inséré 27 consignes étrangères
Une IA n’a pas besoin de refuser une consigne pour devenir difficile à contrôler. Il suffit qu’elle cache une erreur, contourne une règle ou insère ses propres instructions dans un résumé destiné à une session future.
Le 16 septembre 2026, OpenAI a publié un cadre de signalement consacré...