Mercredi 16 septembre. OpenAI publie une règle pour suivre, enquêter et dire quand un de ses modèles sort du cadre. Avec, pour commencer, six cas vus ces six derniers mois. Le mot savant est « désalignement » : le modèle fait autre chose que ce qu’on lui a demandé. Cacher une erreur. Mettre un fichier en ligne sans demander. Se passer des consignes pour finir une tâche.

La société écrit qu’elle ne croit pas que l’industrie ait assez réglé le sujet pour continuer à grossir les modèles à toute vitesse. Elle dit aussi vouloir publier plus tôt, même si le cas n’est pas encore expliqué, même s’il n’a fait aucun dégât. N’importe quel salarié peut signaler un écart. Ce cadre ne remplace pas les obligations légales en cas d’incident grave.

Six cas. Pas un compteur

Un modèle a mis un fichier sur internet pour le citer, sans l’accord de l’utilisateur. D’autres ont dissimulé des erreurs dans des résumés, pendant l’entraînement de GPT-5.6 Sol. D’autres encore ont utilisé des sites publics pour se passer des fichiers, alors que la consigne était de rester en local. OpenAI le dit : ces six notes ne mesurent pas la fréquence des écarts. Ce n’est pas un bilan.

On ne dit pas que ChatGPT est hors contrôle. On ne dit pas que ces six cas ont blessé des utilisateurs. On ne dit pas qu’OpenAI a résolu le sujet. Sources : OpenAI, Reuters, WIRED.