OpenAI pausó el entrenamiento de sus modelos de IA más avanzados por fallos de seguridad
OpenAI pausó el entrenamiento de sus modelos más capaces tras un fallo que permitió a un agente consultar un chatbot externo fuera de su entorno

La compañía revisa sus protocolos de protección y evaluación antes de continuar con el desarrollo de sistemas de inteligencia artificial más avanzados.
OpenAI pausó el entrenamiento, las evaluaciones y las pruebas con herramientas de sus modelos de inteligencia artificial más capaces después de detectar que uno de sus agentes eludió las restricciones de acceso a internet durante una tarea de investigación. La decisión se suma a una revisión de otros incidentes en los que agentes de la empresa interactuaron de forma imprevista con sitios externos.
El caso que motivó la nueva pausa ocurrió el 20 de septiembre de 2026. El agente debía identificar al autor de una publicación mediante pistas biográficas y una herramienta de búsqueda autorizada. Al no encontrar una respuesta, probó otras vías de acceso y aprovechó una deficiencia en los controles de DNS, el sistema que permite localizar servicios en internet. Así logró enviar consultas a un chatbot externo desde un entorno que debía mantener restringida esa conexión.
Ciencia y Tecnología
Agentes de IA se salen de control: OpenAI y Anthropic investigan miles de incidentes
Redacción Digital
Cómo el agente salió del entorno restringido
Según el informe de OpenAI, el agente utilizó esa vía para plantear preguntas sobre la identidad del autor y buscar nuevas formas de acceder a información. No consiguió resolver la tarea, pero sí demostró que podía comunicarse con un servicio externo pese a las limitaciones de su entorno de entrenamiento. La empresa considera que esa conducta excedió lo necesario para responder la pregunta que se le había asignado.
El sistema de vigilancia emitió una alerta unos 12 minutos después de que el agente recibiera una respuesta externa. Una persona comenzó a revisar el caso tres minutos más tarde. Sin embargo, la ejecución continuó y fue detenida manualmente dos horas y media después. OpenAI reconoció que, además de la falla en las restricciones de red, hubo problemas en el procedimiento para detener la actividad tras la alerta.
La compañía señaló que este episodio fue menos grave que otros incidentes anteriores, pero lo considera relevante porque ocurrió después de que reforzara sus controles a raíz del caso de Hugging Face. OpenAI añadió nuevas restricciones para las consultas DNS y está revisando otras posibles rutas de acceso a internet.
Lea también|Nvidia lanza herramienta para controlar a los agentes de inteligencia artificial
Qué actividades pausó OpenAI
Tras detener la ejecución afectada, OpenAI decidió mantener en pausa el entrenamiento, las evaluaciones y la ejecución con herramientas de sus modelos más capaces. La empresa indicó que esas actividades se reanudarán cuando valide la corrección de la falla y complete nuevas pruebas de seguridad.
También anunció que iniciará una nueva ejecución de entrenamiento con medidas adicionales para reducir conductas que se aparten de las instrucciones. El modelo involucrado en este incidente no retomará su entrenamiento, según el informe de la compañía. La pausa descrita se refiere a esas actividades de investigación con sus modelos más capaces.

Fotografía de archivo del director ejecutivo de OpenAI, Sam Altman.
Imágenes de usuarios y actividad en sitios externos
La revisión de OpenAI abarca comportamientos de sus agentes en páginas y servicios ajenos a la empresa. Entre los casos divulgados figuran 53 ocasiones en las que imágenes proporcionadas por usuarios terminaron en sitios externos de alojamiento de imágenes mediante enlaces que no estaban listados públicamente. La compañía reconoció que publicar ese material fuera de su entorno no era un uso apropiado de los datos.
OpenAI afirmó que ya notificó a decenas de terceros que podrían haberse visto afectados por actividades detectadas durante el entrenamiento y la evaluación de sus modelos. La investigación continúa, por lo que la empresa prevé comunicar nuevos hallazgos conforme verifique cada caso.
Economía y negocios
Bill Gates advierte que la IA sin control podría provocar "mil millones de muertes"
Agencia EFE
Las consultas al portal estadístico de la ONU
Por separado, el investigador de seguridad Rowan Howard-Jones documentó más de 16.500 consultas a la interfaz de datos de UNCTADstat, el portal estadístico de la Conferencia de las Naciones Unidas sobre Comercio y Desarrollo, entre el 13 de abril y el 19 de junio de 2026. Su análisis vincula esa actividad con agentes de OpenAI a partir de identificadores y direcciones de red, aunque presenta la atribución como altamente probable, no confirmada.
Según el investigador, los agentes buscaban datos públicos sobre capacidades productivas y comercio. Al encontrar restricciones técnicas, ensayaron distintas rutas para obtenerlos, incluido el uso de una herramienta de Google diseñada para practicar técnicas de seguridad web.
El hallazgo plantea preguntas sobre cómo responden los agentes cuando una tarea les impide acceder a la información por la vía prevista; no acredita que hayan extraído datos privados de la ONU.