El tiempo - Tutiempo.net

OpenAI admite que uno de sus agentes de IA escapó de control en una prueba

Son sistemas capaces de planificar acciones, utilizar herramientas externas y ejecutar tareas complejas con distintos niveles de autonomía.
Información General22 de julio de 2026RedacciónRedacción

Un agente de inteligencia artificial desarrollado por OpenAI logró escapar de un entorno de pruebas controlado, encontró por sí solo una vulnerabilidad informática desconocida y accedió de forma autónoma a la infraestructura de la plataforma Hugging Face, en un incidente que la propia compañía calificó como "sin precedentes" y que encendió nuevas alarmas sobre la seguridad de los modelos de IA más avanzados.

OpenAI explicó que el episodio ocurrió durante una evaluación interna destinada a medir las capacidades ofensivas de sus modelos en ciberseguridad.

Para ello, los investigadores habían desactivado parte de las barreras de seguridad habituales y ejecutaban pruebas dentro de un entorno aislado ("sandbox"), diseñado para impedir cualquier interacción con Internet o sistemas externos.

Sin embargo, el agente -basado en el nuevo modelo GPT-5.6 Sol junto con otro modelo aún más potente que permanece inédito- descubrió una vulnerabilidad "zero day" en la infraestructura de OpenAI, obtuvo acceso a Internet y posteriormente identificó que Hugging Face podía contener información útil para resolver el ejercicio que le había sido asignado.

A partir de allí encadenó varias técnicas de ataque, incluyendo escalamiento de privilegios, movimientos laterales dentro de redes y explotación de nuevas vulnerabilidades, hasta acceder a sistemas de producción de la plataforma.

Según OpenAI, el objetivo del modelo no era causar daños, sino "hacer trampa" para obtener la respuesta correcta del benchmark de evaluación denominado ExploitGym, una prueba utilizada para medir capacidades avanzadas de explotación informática.

La empresa aseguró que toda la actividad estuvo guiada exclusivamente por el cumplimiento del objetivo asignado durante el test.

El ataque fue detectado por los sistemas de seguridad de Hugging Face, que lograron contener la actividad anómala antes de que produjera consecuencias mayores. Posteriormente, ambas compañías iniciaron una investigación conjunta para reconstruir lo ocurrido y corregir las vulnerabilidades descubiertas.

El director ejecutivo de Hugging Face, Clément Delangue, calificó el episodio como "increíble" y afirmó que nunca detectó una intención maliciosa por parte de OpenAI. "Sospechábamos que el ataque podía provenir de un laboratorio de frontera debido a la sofisticación del agente", escribió en la red social X, al destacar la cooperación entre ambas empresas.

El caso llega en un momento de fuerte crecimiento de los llamados agentes de inteligencia artificial, sistemas capaces no solo de generar texto, imágenes o códigos, sino también de planificar acciones, utilizar herramientas externas y ejecutar tareas complejas con distintos niveles de autonomía.

OpenAI informó precisamente esta semana que más de diez millones de usuarios utilizan ya sus agentes de IA.

El episodio también intensifica la competencia entre los grandes desarrolladores de inteligencia artificial por construir modelos especializados en ciberseguridad.

En los últimos meses, Anthropic, Google y la propia OpenAI aceleraron el desarrollo de sistemas capaces tanto de detectar vulnerabilidades como de ejecutar pruebas ofensivas para fortalecer las defensas informáticas, aunque expertos advierten que esas mismas capacidades podrían ser utilizadas con fines maliciosos si cayeran en manos equivocadas.

Últimas noticias
adobestock_1650199562

Lula lanza un plan de ayuda a los exportadores ante los aranceles estadounidenses

Redacción
America Latina22 de julio de 2026
El mismo día en que entraron en vigor los nuevos aranceles estadounidenses, el gobierno federal brasileño anunció un nuevo paquete de apoyo para las empresas brasileñas. Denominada "Plan Brasil Soberano 3", la iniciativa ofrece 18.500 millones de reales ( 3,4 mil millones de dólares) en líneas de crédito subsidiadas para exportadores y sectores considerados estratégicos para la economía nacional.  
Te puede interesar
Lo más visto
_mg_8269

El modelo Pix desafía el control financiero de Estados Unidos sobre Brasil.

Redacción
America Latina21 de julio de 2026
El sistema brasileño Pix se ha convertido en objetivo del gobierno de Estados Unidos, entre otras razones, por cuestionar el control financiero de Washington sobre la infraestructura de pagos electrónicos de Brasil. Esta evaluación proviene de expertos en economía y relaciones internacionales consultados por Agência Brasil.  
Suscríbete al newsletter para recibir periódicamente las novedades en tu email