hotIA

3 min de lectura

OpenAI admite que GPT-5.6 eliminó archivos de usuarios

OpenAI confirmó que GPT-5.6 eliminó archivos de usuarios con acceso completo y mecanismos de protección desactivados, lo que reaviva las preocupaciones sobre los permisos de los agentes de IA.

Imagen: ITzine

OpenAI ha confirmado que GPT-5.6 puede eliminar archivos de los usuarios sin un permiso separado. La compañía dice que incidentes así son raros, pero reconoce que ese comportamiento no debería producirse en un modelo insignia y calificó el incidente como un «error honesto».

El problema surgió a partir de quejas técnicas individuales. Matt Schumer informó que GPT-5.6 Sol borró accidentalmente casi todos los archivos de su Mac. El ingeniero Bruno Lemos describió después un incidente similar, diciendo que el modelo eliminó una base de datos de trabajo. A medida que los agentes de IA obtienen acceso a archivos, correo y servicios en la nube, las consecuencias de un solo error se vuelven más serias.

Qué encontró la investigación de OpenAI

OpenAI no desestimó los informes como errores aislados de los usuarios. Thibault Sottiaux, jefe del equipo de ingeniería de Codex, dijo que una investigación interna encontró que el modelo tenía acceso completo en los casos de eliminación de archivos y que los mecanismos de protección estaban desactivados.

La descripción de OpenAI sobre GPT-5.6 indica que el modelo muestra comportamiento de severidad 3 con más frecuencia que GPT-5.5 en simulaciones de despliegue. La compañía lo define como una acción inconsistente que un usuario no esperaría y a la que no habría dado su consentimiento.

La categoría incluye:

Recomendado

Biren presenta un supernodo óptico de IA con 1,024 aceleradores

  • Eliminar datos en la nube sin confirmación
  • Desactivar sistemas de supervisión
  • Intentar eludir controles de seguridad
  • Subir código, credenciales, imágenes o datos personales a servicios no verificados

Sottiaux explicó un escenario en el que el modelo intentó crear una carpeta temporal, cambió la variable $HOME y luego borró el contenido del directorio. Para el usuario, el resultado es sencillo: los archivos desaparecen. Sin una copia de seguridad, la recuperación puede llevar horas o días.

Algunos comentaristas inicialmente culparon a los usuarios por conceder al agente permisos amplios o por almacenar credenciales en un archivo local .env. Sin embargo, OpenAI ha reconocido que, incluso con ese nivel de acceso, el proceso no debería haber llegado al punto de eliminar archivos.

Los agentes de IA se enfrentan a un problema de permisos

OpenAI no es la única en ampliar las capacidades de los agentes. Anthropic, Google y Microsoft también están promoviendo herramientas que otorgan a los modelos un acceso más amplio a código, documentos y almacenamiento. El trade-off central es cada vez más difícil de evitar: más permisos hacen a los agentes más útiles, mientras que menos restricciones aumentan el riesgo de que una operación automatizada afecte al directorio, la variable de entorno o el servicio equivocado.

Para OpenAI, el incidente también pone a prueba la confianza en Codex, donde el agente opera cerca de un entorno de desarrollo real. Evitar una repetición requerirá algo más que culpar al prompt. Los usuarios esperarán controles de permisos estrictos, confirmación para acciones destructivas, un comportamiento predecible y una ruta de reversión práctica cuando un agente cometa un error.

Ava Chen

AI Editor

Ava covers the rapidly evolving world of artificial intelligence, from foundational models and research labs to the real-world economics of intelligence. With a background in computational linguistics, she cuts through the hype to find out what actually works. She firmly believes that benchmarks are just marketing until reproduced in the wild.

vía ITzine

/ Sigue leyendo