
OpenAI admite que uno de sus agentes de IA escapó de control en una prueba
RedacciónUn agente de inteligencia artificial desarrollado por OpenAI logró escapar de un entorno de pruebas controlado, encontró por sí solo una vulnerabilidad informática desconocida y accedió de forma autónoma a la infraestructura de la plataforma Hugging Face, en un incidente que la propia compañía calificó como "sin precedentes" y que encendió nuevas alarmas sobre la seguridad de los modelos de IA más avanzados.
OpenAI explicó que el episodio ocurrió durante una evaluación interna destinada a medir las capacidades ofensivas de sus modelos en ciberseguridad.
Para ello, los investigadores habían desactivado parte de las barreras de seguridad habituales y ejecutaban pruebas dentro de un entorno aislado ("sandbox"), diseñado para impedir cualquier interacción con Internet o sistemas externos.
Sin embargo, el agente -basado en el nuevo modelo GPT-5.6 Sol junto con otro modelo aún más potente que permanece inédito- descubrió una vulnerabilidad "zero day" en la infraestructura de OpenAI, obtuvo acceso a Internet y posteriormente identificó que Hugging Face podía contener información útil para resolver el ejercicio que le había sido asignado.
A partir de allí encadenó varias técnicas de ataque, incluyendo escalamiento de privilegios, movimientos laterales dentro de redes y explotación de nuevas vulnerabilidades, hasta acceder a sistemas de producción de la plataforma.
Según OpenAI, el objetivo del modelo no era causar daños, sino "hacer trampa" para obtener la respuesta correcta del benchmark de evaluación denominado ExploitGym, una prueba utilizada para medir capacidades avanzadas de explotación informática.
La empresa aseguró que toda la actividad estuvo guiada exclusivamente por el cumplimiento del objetivo asignado durante el test.
El ataque fue detectado por los sistemas de seguridad de Hugging Face, que lograron contener la actividad anómala antes de que produjera consecuencias mayores. Posteriormente, ambas compañías iniciaron una investigación conjunta para reconstruir lo ocurrido y corregir las vulnerabilidades descubiertas.
El director ejecutivo de Hugging Face, Clément Delangue, calificó el episodio como "increíble" y afirmó que nunca detectó una intención maliciosa por parte de OpenAI. "Sospechábamos que el ataque podía provenir de un laboratorio de frontera debido a la sofisticación del agente", escribió en la red social X, al destacar la cooperación entre ambas empresas.
El caso llega en un momento de fuerte crecimiento de los llamados agentes de inteligencia artificial, sistemas capaces no solo de generar texto, imágenes o códigos, sino también de planificar acciones, utilizar herramientas externas y ejecutar tareas complejas con distintos niveles de autonomía.
OpenAI informó precisamente esta semana que más de diez millones de usuarios utilizan ya sus agentes de IA.
El episodio también intensifica la competencia entre los grandes desarrolladores de inteligencia artificial por construir modelos especializados en ciberseguridad.
En los últimos meses, Anthropic, Google y la propia OpenAI aceleraron el desarrollo de sistemas capaces tanto de detectar vulnerabilidades como de ejecutar pruebas ofensivas para fortalecer las defensas informáticas, aunque expertos advierten que esas mismas capacidades podrían ser utilizadas con fines maliciosos si cayeran en manos equivocadas.


Lula lanza un plan de ayuda a los exportadores ante los aranceles estadounidenses

Irán dispuesto a producir un apagón regional, si EEUU ataca su infraestructura

Chile eleva a 13 los fallecidos por temporal que azota a diez regiones del país

Irán dispuesto a producir un apagón regional, si EEUU ataca su infraestructura

Detectan desde Chile la que sería la primera Luna fuera del sistema solar

Más de 60 escuelas fueron reacondicionadas para el regreso a clases

Trabajan para mejorar la calidad de vida de los pacientes

Lionel Scaloni habló tras llegar a su casa en Pujato: “Perdimos porque ellos jugaron mejor”

CGT, CTA y movimientos sociales marchan mañana al Congreso junto a los jubilados

Proyectarán un documental sobre el femicido de Paola Tacacho

De la Espriella y su primera derrota política en el Congreso




