Le GPT-5.6 Sol d’OpenAI fait l’objet de plaintes de développeurs qui affirment que le modèle a supprimé des fichiers locaux et des données en production alors qu’il travaillait sur leurs systèmes.
Trois développeurs ont décrit des incidents distincts au cours desquels le modèle de programmation aurait dépassé le cadre du travail qui lui avait été confié, entraînant une perte de données. L’un d’eux a déclaré que les dégâts avaient commencé une fois la tâche demandée terminée, et OpenAI avait documenté un comportement similaire lors de tests avant de publier son modèle phare.
Aucun défaut unique n’a été confirmé, mais chaque signalement met en cause le même risque. Une seule commande erronée peut causer des dégâts immédiats lorsqu’un agent de programmation a un accès direct au système.
Une tâche s’est terminée, puis le nettoyage a commencé
Le développeur Joey Kudish a déclaré sur X que le modèle d’IA avait correctement terminé sa tâche avant d’entamer un nettoyage qu’il n’avait jamais demandé. Selon Kudish, un chemin incorrect ou incomplet a été transmis à un sous-agent, qui a alors commencé à supprimer des fichiers de son répertoire personnel.
Les sauvegardes lui ont permis de récupérer ses données, mais Kudish a déclaré que Sol devait être « bridé ».
Kudish n’était pas le seul. Gizmodo a rapporté deux plaintes similaires d’utilisateurs qui affirment que GPT-5.6 Sol a effacé des données alors qu’il travaillait sur leurs systèmes.
Le développeur brésilien Bruno Lemos a déclaré que le modèle avait endommagé une base de données de production en fonctionnement. Une capture d’écran le montrait disant avoir « exécuté par erreur des tests d’intégration destructeurs », vidant les tables de la base de données.
L’investisseur spécialisé dans les technologies Matt Shumer a décrit un « grave incident de perte de données locales » qui a supprimé ce qu’il a qualifié de « presque TOUS » les fichiers de son Mac. Sa capture d’écran montrait l’agent de programmation exécutant une commande rm -rf qui supprime définitivement les fichiers spécifiés au lieu de les déplacer vers la Corbeille.
Shumer a reconnu avoir utilisé le mode d’accès complet, qui permet au système de s’exécuter directement sur son ordinateur.
OpenAI n’a pas répondu à la demande de commentaire de Gizmodo avant la publication. Shumer a déclaré plus tard que le président de l’entreprise, Greg Brockman, l’avait contacté et lui avait proposé son aide.
OpenAI avait déjà constaté des dépassements de périmètre destructeurs
Selon la fiche système de GPT-5.6, son dernier modèle pouvait devenir excessivement persistant et partir du principe que les actions sont autorisées tant qu’elles ne sont pas explicitement interdites. Un tel comportement pouvait l’amener à poursuivre son action au-delà de la tâche souhaitée par l’utilisateur, ce qui a conduit l’entreprise à recommander une supervision lors des tâches de programmation prolongées.
Un cas interne concernait un utilisateur qui avait autorisé la suppression de trois machines virtuelles désignées par leur nom. Après ne pas les avoir trouvées, l’agent de programmation a choisi trois autres machines sans demander confirmation, arrêté des processus actifs et forcé la suppression d’espaces de travail de programmation. Le travail non validé a peut-être été perdu avant que l’utilisateur ne réagisse.
L’entreprise d’IA a également constaté que le nouveau modèle était légèrement moins fiable que GPT-5.5 lorsqu’il s’agissait de laisser intactes les données protégées des utilisateurs. En clair, il était quelque peu plus susceptible de modifier des fichiers sans rapport avec la tâche en cours. OpenAI a déclaré que les défaillances graves restaient rares.
L’accès complet ne laisse guère de marge à une commande erronée
Les développeurs et les équipes informatiques sont les plus exposés lorsque les agents de programmation peuvent accéder directement à des systèmes sensibles. Un chemin ou une commande de nettoyage erroné peut effacer des données avant que quiconque ne s’en aperçoive.
Une mauvaise réponse d’un chatbot attend généralement qu’une personne agisse. Un agent de programmation autorisé à modifier ou supprimer des fichiers peut exécuter lui-même l’erreur, laissant peu de temps pour l’arrêter.
Des contrôles d’accès plus stricts peuvent limiter les dégâts, et les sauvegardes offrent une possibilité de récupération. Les dossiers sensibles doivent rester hors d’atteinte, et la suppression de fichiers ou la réinitialisation de bases de données devraient nécessiter une autorisation distincte.
À lire également : la prochaine expansion de ChatGPT pourrait faire entrer l’IA plus profondément dans les foyers, où la confidentialité et les accès partagés deviennent plus difficiles à gérer.

