Sobre el "incidente cibernético sin precedentes" de OpenAI

23 jul. 2026

Marisa Delgado

OpenAI ha hecho público hace dos días un grave incidente de ciberseguridad que quería comentar por aquí para que cada uno extraiga sus propias conclusiones.

A quienes tenéis hijos os sonará la etapa "Yo solito".

Inevitable recordarla al leer el comunicado de OpenAI*.

La semana pasada, durante una evaluación interna, OpenAI estaba poniendo a prueba dos de sus modelos con mayores capacidades en ciberseguridad: GPT-5.6 Sol y otro modelo todavía no publicado. Los modelos se ejecutaban dentro de un sandbox (un entorno aislado), precisamente para impedir que pudieran interactuar con sistemas externos. Pero OpenAI desactivó las salvaguardas que impiden a sus modelos realizar actividades de riesgo. Es decir, les quitó los frenos deliberadamente.

La sorpresa (¿o no tanto?): los modelos encontraron una vulnerabilidad de día cero que les permitió salir del entorno aislado, alcanzar un equipo con acceso a Internet y dedujeron que Hugging Face, la mayor plataforma del mundo para compartir modelos y conjuntos de datos de IA, podía contener información útil para resolver la prueba. A partir de ahí, los modelos fueron encadenando distintas vulnerabilidades y utilizando credenciales robadas hasta conseguir ejecutar código de forma remota en infraestructura de Hugging Face.

Ellos solitos.

La buena noticia es que la actividad fue detectada y contenida por los equipos de seguridad de Hugging Face y OpenAI. De hecho, OpenAI ha decidido hacerlo público y lo ha calificado literalmente como "incidente cibernético sin precedentes".

Todo esto ocurrió en cuestión de días y sin que hubiera una persona indicando a los modelos qué debían hacer. Los modelos tenían un único objetivo: superar la prueba. Y fueron tomando decisiones de forma autónoma para conseguirlo, incluyendo conseguir acceso a internet, robar credenciales y comprometer la infraestructura de una empresa que no tenía nada que ver con el test. Ellos solitos.

No sé si esta noticia debe generar miedo.

Pero sí creo que debería preocuparnos un poco. Porque cuando le quitas los frenos a un modelo para ver de qué es capaz, y él solito consigue encontrar un error día cero, robar credenciales y entrar en la infraestructura de otra empresa sin que nadie se lo pidiera paso a paso, ya no estamos hablando de un experimento controlado, sino de descontrol absoluto. Y eso, en manos de los malos, sí que me da MUCHO miedo.

La IA generativa va a una velocidad de vértigo y tenemos que prepararnos.

Llevamos meses diciendo que la IA dejaría de limitarse a responder para empezar a actuar. Creo que este es uno de los primeros ejemplos reales de lo que eso significa. Ya no estamos hablando de modelos que responden preguntas, sino de modelos que, sin las salvaguardas adecuadas, son capaces de mantener un objetivo, adaptar su estrategia, utilizar herramientas y encontrar caminos que ni sus propios diseñadores habían previsto.

Ellos solitos.

*Comunicado de OpenAI

Etiquetas:
Tecnología
Buscador de artículos
Últimos Artículos
Sobre el "incidente cibernético sin precedentes" de OpenAI
Sobre el "incidente cibernético sin precedentes" de OpenAI
23 jul. 2026
Ciberseguridad estival: Cómo proteger tu despacho (y tu tranquilidad) este verano
Ciberseguridad estival: Cómo proteger tu despacho (y tu tranquilidad) este...
21 jul. 2026
El cliente no es tuyo (aunque creas que sí)
El cliente no es tuyo (aunque creas que sí)
14 jul. 2026
“En 2030 nadie podrá justificar un precio solo por las horas invertidas”
“En 2030 nadie podrá justificar un precio solo por las horas invertidas”
08 jul. 2026
Por etiquetas
Inkietos
30
Tendencias del sector
26
Finanzas
2
Libro
11
Marketing
18
Innovación
45
Comunicación
12
Gestión del talento
27
Tecnología
43
Desarrollo de negocio
31
Estrategia
7
Estudio
1
Informe
1

Nuestro partner

harvey

Newsletter

Recibe mensualmente información relevante de nuestra actividad.