Publicado: julio 22, 2026, 12:00 pm
La fuente de la noticia es https://www.20minutos.es/tecnologia/actualidad/openai-reconoce-un-incidente-sin-precedentes-su-ia-escapo-una-prueba-ataco-otra-empresa_7017850_0.html
OpenAI ha reconocido que uno de sus modelos más avanzados protagonizó un incidente que la compañía propietaria de ChatGPT califica como «sin precedentes». Uno de sus modelos más avanzados consiguió escapar de un entorno de pruebas y lanzó un ataque contra Hugging Face, otra empresa especializada en inteligencia artificial. Tal y como informan desde Reuters y desde la propia empresa de Sam Altman a través de un comunicado oficial, todo ocurrió durante una prueba interna en la que la firma estaba poniendo a prueba GPT 5.6 Sol y otro modelo todavía más avanzado que aún no ha sido lanzado al público.
El plan era comprobar hasta dónde podían llegar sus capacidades en ciberseguridad, por lo que ambos modelos tenían que encontrar vulnerabilidades informáticas, encadenarlas y completar con éxito un ataque dentro de un entorno completamente controlado y aislado de internet. Sin embargo, las cosas no salieron como estaban previstas, ya que el agente de IA encontró por sí mismo una vulnerabilidad de día cero en uno de los sistemas internos que limitaban su acceso.
El modelo fue capaz de tomar decisiones de forma autónoma para avanzar
Gracias a ese fallo, consiguió aumentar sus permisos, desplazarse por diferentes equipos de la red y alcanzar una máquina que sí tenía conexión a internet. En ese momento, el modelo dejó de estar limitado al laboratorio donde se estaba realizando la prueba. Cuando consiguió acceder a la red, el sistema llegó a la conclusión de que Hugging Face podía contener información útil para resolver una prueba de ciberseguridad llamada «ExploitGym» que estaba realizando durante la evaluación. La plataforma contiene millones de modelos abiertos de inteligencia artificial y conjuntos de datos, por lo que el agente decidió convertirla en su objetivo. A partir de ahí comenzó el ataque.
El modelo fue capaz de combinar diferentes técnicas por iniciativa propia, como credenciales robadas y vulnerabilidades de día cero, para acceder a la infraestructura de Hugging Face y obtener información relacionada con la prueba. Insisten en que el sistema no siguió una secuencia de instrucciones preparada por un humano, sino que fue tomando decisiones de forma autónoma para avanzar. Por otra parte, el equipo de seguridad de la otra compañía detectó rápidamente que algo no iba bien, ya que durante solo un fin de semana registró más de 17.000 eventos relacionados con actividad del agente de IA, una cifra que refleja la enorme cantidad de acciones que llegó a ejecutar mientras buscaba nuevas formas de acceder a los sistemas.
«Un incidente cibernético sin precedentes»
La actividad permitió identificar el acceso no autorizado, contener el incidente y comenzar la reconstrucción de parte de la infraestructura afectada. De hecho, han destacado que este ataque era diferente a cualquier otro que hubiera gestionado anteriormente, pues toda la intrusión estuvo dirigida de principio a fin por un agente de inteligencia artificial autónomo. Tras el incidente, OpenAI ha asegurado que ya trabaja junto a Hugging Face para investigar lo ocurrido y reforzar la seguridad de futuras evaluaciones. También ha endurecido la configuración de sus entornos de prueba para evitar que esto pueda volver a pasar, algo que han definido como «un incidente cibernético sin precedentes».
Admiten que la investigación sigue abierta, por lo que las conclusiones todavía son provisionales. Además, el director ejecutivo de Hugging Face, Clem Delangue, considera que esto demuestra que la seguridad de la IA no puede depender de una sola empresa y defiende una mayor colaboración entre toda la industria para afrontar este tipo de riesgos. Por no hablar de que esto también muestra que estos sistemas ya son capaces de descubrir debilidades, combinar diferentes técnicas a la par que ejecutar miles de acciones de forma autónoma para alcanzar un objetivo. A pesar de que todo ocurrió durante una prueba controlada, los hechos han reabierto este debate.
