Publicado: julio 22, 2026, 7:00 am
La fuente de la noticia es https://www.abc.es/tecnologia/openai-reconoce-modelos-inteligencia-artificial-hackeo-plataforma-20260722100116-nt.html
OpenAI ha anunciado este martes que sus modelos avanzados de inteligencia artificial se han salido de control durante unas pruebas de seguridad y han vulnerado una conocida plataforma para desarrolladores Hugging Face.
La compañía, con sede en San Francisco, ha calificado el suceso como un « … ciberincidente sin precedentes» y ha informado de que llevará a cabo una investigación conjunta con Hugging Face, la plataforma afectada. Los modelos de IA que alimentan herramientas como los chatbots o los generadores de imágenes reciben el nombre de agentes cuando operan de manera autónoma para ejecutar tareas en el mundo real.
Conforme esta tecnología se vuelve más sofisticada, la ciberseguridad cobra mayor importancia, ya que existe el riesgo de que las IA avanzadas detecten fallos de seguridad en el software antes que los expertos humanos.
Noticia relacionada
OpenAI ha señalado que en el incidente ha intervenido una combinación de modelos, entre los que figuraban GPT-5.6 Sol -que han presentado recientemente- y un modelo todavía más potente que está en fase previa a su lanzamiento. La empresa ha evaluado la capacidad de los modelos para eludir sistemas de seguridad mediante tareas en un entorno digital de pruebas estrictamente aislado, donde han restringido el acceso a internet por motivos de seguridad.
«Mientras han operado en nuestro entorno aislado, los modelos han empleado una cantidad considerable de potencia de cálculo para hallar la manera de acceder a internet y resolver el problema planteado», han explicado desde OpenAI en una entrada de su blog. Una vez conectados a internet, los modelos han atacado la plataforma Hugging Face -un amplio repositorio de modelos de IA, conjuntos de datos y otros recursos- con el fin de facilitar su objetivo.
La IA penetró en el propio sistema interno para aprovechar las debilidades
Con el propósito de hallar «información confidencial» para manipular la evaluación, el sistema de OpenAI ha encadenado diversos vectores de ataque, entre los que ha incluido el uso de credenciales sustraídas. Hussein Abbass, profesor de Informática en la UNSW Canberra, ha declarado a la agencia AFP que el suceso resulta «asombroso en muchos aspectos».
«No solo ha atacado Hugging Face, sino que además ha penetrado en su propio sistema interno para aprovechar sus vulnerabilidades», ha afirmado Abbass. «Y eso resulta inquietante». GPT-5.6 y otros modelos punteros -como la serie Mythos de Anthropic, el principal competidor de OpenAI- han despertado preocupación por su capacidad para romper las defensas de ciberseguridad.
Ambas compañías estadounidenses han tenido que pausar temporalmente el lanzamiento general de estas tecnologías tras el temor en Washington de que facilitaran la infiltración en infraestructuras críticas. «Por lo general, la IA avanzada se encuentra en manos de personas éticas y responsables», ha señalado Abbass. «Sin embargo, resultará catastrófico si cae en manos de alguien con la intención de causar daño».
La regulación del sector de la IA se ha convertido en una cuestión prioritaria: «Necesitamos un esfuerzo conjunto para gestionar esta situación», ha añadido. Hugging Face ha comunicado la «intrusión» informática la semana pasada, sin nombrar directamente a OpenAI.
«Este ataque se ha diferenciado de todos los anteriores en un aspecto clave: lo ha impulsado, de principio a fin, un sistema de agente de IA autónomo, y lo hemos detectado y analizado mayoritariamente mediante nuestra propia IA», han declarado desde Hugging Face. Clément Delangue, director ejecutivo de Hugging Face, ha señalado en la red social X que la empresa sospechaba que el ataque procedía de un laboratorio de IA de primer nivel, dada la sofisticación del agente. «Estamos convencidos de que no existía mala intención por su parte», ha escrito Delangue en referencia a OpenAI. «¡Ha resulta
