Simon Willison→ original

Баг в Codex: GPT-5.6 удалял файлы пользователей — OpenAI объяснила причину

OpenAI подтвердила: агент Codex с моделью GPT-5.6 в редких случаях неожиданно удалял файлы пользователей. По данным компании, это происходит, когда включён режим полного доступа без песочницы, а модель пытается переопределить переменную $HOME под временную папку — и по ошибке стирает саму домашнюю директорию со всеми настройками и ключами.

Procesado por IA desde Simon Willison; editado por Hamidun News
Баг в Codex: GPT-5.6 удалял файлы пользователей — OpenAI объяснила причину
Fuente: Simon Willison. Collage: Hamidun News.
◐ Escuchar artículo

El 16 de julio de 2026, OpenAI confirmó un peligroso bug en su agente de codificación Codex: en determinados casos, el modelo GPT-5.6 eliminaba inesperadamente archivos de los usuarios, incluido el contenido de la carpeta de inicio ($HOME).

Qué es exactamente lo que ocurre

Codex elimina archivos cuando coinciden a la vez tres condiciones, según explicó Thibault Sottiaux, de OpenAI, tras analizar varias quejas de usuarios. Según la compañía, el fallo destructivo se produce casi siempre en el mismo escenario, y no de forma aleatoria.

Codex es un agente de IA de consola de OpenAI: recibe una tarea en lenguaje natural y ejecuta él mismo comandos en la terminal —crea archivos, ejecuta scripts, corrige código—. El bug aparece cuando se permite al agente actuar sin restricciones.

  • Está activado el modo de acceso total (full access) y Codex se ejecuta sin protecciones de sandbox, incluida la ausencia de auto-revisión de comandos
  • El modelo GPT-5.6 intenta redefinir la variable de entorno $HOME para establecer un directorio temporal
  • El modelo comete un error y elimina la propia carpeta $HOME en lugar de la temporal
«Sobre la eliminación de archivos.

Investigamos varios reportes de que GPT-5.6 eliminaba archivos de forma inesperada» —Thibault Sottiaux, OpenAI, en la red social X.

Por qué es importante

Codex opera con los permisos del propio usuario, por lo que su error afecta a archivos reales y no a una copia aislada. Cuando las capas de protección están desactivadas, el modelo ejecuta comandos directamente en el sistema, y un comando de eliminación erróneo borra datos reales. Redefinir $HOME es especialmente peligroso: en el directorio de inicio suelen estar las configuraciones, las claves SSH, los tokens de acceso y los proyectos de trabajo.

Simon Willison, autor de un popular blog técnico sobre IA, calificó el caso como «un bug de Codex bastante desagradable». El problema no está en una errata puntual en el código, sino en un riesgo sistémico: un agente con acceso total y sin sandbox puede destruir datos por un único error lógico en el razonamiento del modelo GPT-5.6.

Sottiaux subraya que se trata de un «error honesto» (honest mistake): el modelo no actúa con mala intención, sino que se equivoca en la lógica al intentar crear una carpeta temporal. Para el usuario, la diferencia es mínima: el resultado es el mismo, archivos perdidos. Por eso OpenAI no está registrando un defecto aislado, sino una clase de comportamiento que se repite entre distintos usuarios con configuraciones similares.

Cómo reducir el riesgo

No desactivar el sandbox ni la auto-revisión de comandos: es la conclusión directa de la explicación de OpenAI. El escenario destructivo requiere precisamente esa combinación: modo de acceso total más ausencia de aislamiento. El sandbox limita las operaciones de archivos del agente al directorio de trabajo, y la auto-revisión muestra el comando al usuario antes de ejecutarlo, dando la posibilidad de cancelar una eliminación peligrosa antes de que ocurra.

El modo de acceso total no existe por casualidad: es necesario cuando un desarrollador quiere que el agente trabaje sin solicitudes constantes de confirmación —instalando dependencias, modificando archivos del sistema, ejecutando pipelines largos—. La comodidad conlleva riesgo: sin sandbox, el modelo no tiene ninguna red de seguridad contra su propio error.

Qué significa esto

La historia de Codex muestra el precio de la autonomía de los agentes de IA: cuantos más permisos tiene un modelo, más cara resulta su equivocación. El sandbox y la confirmación de comandos no son burocracia, sino la última línea de defensa entre un error honesto del modelo y un disco borrado.

Preguntas frecuentes

¿Por qué Codex eliminaba archivos?

Según OpenAI, el modelo GPT-5.6 intentaba redefinir la variable $HOME hacia un directorio temporal y, por error, eliminaba la propia carpeta de inicio. El fallo se producía con el modo de acceso total activado, sin protecciones de sandbox y sin auto-revisión de comandos.

¿Cómo evitar perder archivos al trabajar con Codex?

No desactivar el sandbox ni la auto-revisión. OpenAI señala que el escenario peligroso surge precisamente en el modo full access sin aislamiento, cuando el modelo puede ejecutar comandos de eliminación directamente, sin una comprobación intermedia.

ZK
Hamidun News
Noticias de AI sin ruido. Selección editorial diaria de más de 50 fuentes. Producto de Zhemal Khamidun, Head of AI en Alpina Digital.

¿Quieres dejar de leer sobre IA y empezar a usarla?

AI News es un feed curado de noticias de IA. Hamidun Academy te enseña a usar la IA en tu trabajo.

¿Qué te parece?
Cargando comentarios…