Баг в Codex: GPT-5.6 удалял файлы пользователей — OpenAI объяснила причину
OpenAI подтвердила: агент Codex с моделью GPT-5.6 в редких случаях неожиданно удалял файлы пользователей. По данным компании, это происходит, когда включён режим полного доступа без песочницы, а модель пытается переопределить переменную $HOME под временную папку — и по ошибке стирает саму домашнюю директорию со всеми настройками и ключами.
Traité par IA depuis Simon Willison ; édité par Hamidun News
Le 16 juillet 2026, OpenAI a confirmé un bug dangereux dans son agent de codage Codex : dans certains cas, le modèle GPT-5.6 supprimait de manière inattendue des fichiers d'utilisateurs — allant jusqu'au contenu du dossier personnel ($HOME).
Ce qui se passe exactement
Codex supprime des fichiers lorsque trois conditions se réunissent en même temps — c'est ce qu'a écrit Thibault Sottiaux, d'OpenAI, après avoir examiné plusieurs plaintes d'utilisateurs. Selon l'entreprise, la panne destructrice survient presque toujours selon le même scénario, et non de façon aléatoire.
Codex est un agent d'IA en ligne de commande d'OpenAI : il reçoit une tâche en langage naturel et exécute lui-même des commandes dans le terminal — il crée des fichiers, lance des scripts, corrige du code. Le bug apparaît lorsque l'agent est autorisé à agir sans restrictions.
- Le mode d'accès complet (full access) est activé, et Codex fonctionne sans protections sandbox — y compris sans auto-révision des commandes
- Le modèle GPT-5.6 tente de redéfinir la variable d'environnement $HOME afin de fixer un répertoire temporaire
- Le modèle commet une erreur et supprime le dossier $HOME lui-même au lieu du dossier temporaire
« Concernant la suppression de fichiers.
Nous avons enquêté sur plusieurs signalements selon lesquels GPT-5.6 supprimait des fichiers de manière inattendue » — Thibault Sottiaux, OpenAI, sur le réseau social X.
Pourquoi c'est important
Codex opère avec les droits de l'utilisateur lui-même, donc son erreur touche des fichiers réels, et non une copie isolée. Lorsque les couches de protection sont désactivées, le modèle exécute les commandes directement dans le système — et une commande de suppression erronée efface des données réelles. Redéfinir $HOME est particulièrement dangereux : le répertoire personnel contient généralement les configurations, les clés SSH, les jetons d'accès et les projets de travail.
Simon Willison, auteur d'un blog technique populaire sur l'IA, a qualifié le cas de « bug de Codex plutôt désagréable ». Le problème ne réside pas dans une simple coquille dans le code, mais dans un risque systémique : un agent disposant d'un accès complet et dépourvu de sandbox peut détruire des données à cause d'une seule erreur logique dans le raisonnement du modèle GPT-5.6.
Sottiaux souligne qu'il s'agit d'une « erreur honnête » (honest mistake) — le modèle n'agit pas avec malveillance, il se trompe dans la logique en tentant de créer un dossier temporaire. Pour l'utilisateur, la différence est minime : le résultat est le même — des fichiers perdus. C'est précisément pour cela qu'OpenAI ne constate pas un défaut isolé, mais une classe de comportement qui se répète chez différents utilisateurs avec des configurations similaires.
Comment réduire le risque
Ne pas désactiver le sandbox ni l'auto-révision des commandes — c'est la conclusion directe de la description d'OpenAI. Le scénario destructeur exige précisément cette combinaison : mode d'accès complet plus absence d'isolation. Le sandbox limite les opérations sur les fichiers de l'agent au périmètre du répertoire de travail, et l'auto-révision affiche la commande à l'utilisateur avant son exécution, donnant une chance d'annuler une suppression dangereuse avant qu'elle ne se produise.
Le mode d'accès complet n'existe pas par hasard — il est nécessaire lorsqu'un développeur veut que l'agent travaille sans demandes de confirmation constantes : installer des dépendances, modifier des fichiers système, exécuter de longs pipelines. Le confort se paie en risque : sans sandbox, le modèle n'a aucune protection contre sa propre erreur.
Ce que cela signifie
L'histoire de Codex montre le prix de l'autonomie des agents d'IA : plus un modèle dispose de droits, plus son erreur coûte cher. Le sandbox et la confirmation des commandes ne relèvent pas de la bureaucratie, mais constituent la dernière ligne de défense entre une erreur honnête du modèle et un disque effacé.
Questions fréquentes
Pourquoi Codex supprimait-il des fichiers ?
Selon OpenAI, le modèle GPT-5.6 tentait de redéfinir la variable $HOME vers un répertoire temporaire et supprimait par erreur le dossier personnel lui-même. La panne survenait lorsque le mode d'accès complet était activé sans protections sandbox et sans auto-révision des commandes.
Comment ne pas perdre de fichiers en travaillant avec
Codex ?
Ne pas désactiver le sandbox ni l'auto-révision. OpenAI indique que le scénario dangereux survient précisément en mode full access sans isolation — lorsque le modèle peut exécuter directement des commandes de suppression, sans vérification intermédiaire.
Vous voulez cesser de lire sur l'IA et commencer à l'utiliser?
AI News est un fil d'actualité IA. Hamidun Academy vous apprend à utiliser l'IA dans votre travail.
L'essentiel de l'IA — une fois par semaine
Sept actus qui ont vraiment compté, choisies à la main. Sans bruit ni communiqués.
C'est fait ! Vérifiez votre boîte mail pour la confirmation.