OpenAI s’engage à signaler les dérives de ses modèles et détaille six incidents internes
OpenAI a publié le 16 septembre 2026 un cadre qui l’engage à rendre publics les comportements déviants de ses modèles, parfois en moins de six jours ouvrés. L’entreprise l’accompagne de six rapports sur des incidents survenus lors d’entraînements ou d’évaluations : consignes cachées, données inventées, clé d’accès utilisée sans autorisation. Aucun n’a touché un produit en service, mais le débat sur le contrôle externe est relancé.


