Logran 'hackear' a OpenAI en 72 horas utilizando la IA de Anthropic - Mexico
Registro  /  Login

Otro sitio más de Gerente.com


Logran 'hackear' a OpenAI en 72 horas utilizando la IA de Anthropic

Publicado: septiembre 18, 2026, 10:48 am

Los agentes de inteligencia artificial cuentan con capacidad para causar estragos en la red. Así lo demuestra los incidentes de seguridad protagonizados por esta clase de tecnología durante los últimos meses. Ahora, un equipo de investigadores de seguridad de la empresa Hacktron AI ha anunciado que ha sido capaz de ‘hackear’ de forma exitosa a la empresa de IA OpenAI mediante el empleo de Claude Opus 5, uno de los modelos más avanzados de Anthropic. Y, para lograrlo, solo necesitó 72 horas. «No creo que seamos tan buenos como los actores chinos especializados en ciberamenazas. Solo somos tres tipos con suscripciones a Claude y Codex», ha señalado Mohan Pedhapati, director tecnológico de la empresa a ‘ The Wall Street Journal ‘, medio que adelantó la noticia. El equipo de Hacktron AI logró acceder a los sistemas de la empresa el pasado 25 de julio. El ataque comenzó en el foro de la comunidad de OpenAI, alojado en Discourse, una plataforma de código abierto para la creación y gestión de comunidades en internet. Los investigadores consiguieron explotar dos vulnerabilidades críticas que, juntas, les permitieron comprometer las cuentas de ChatGPT y Codex de varios empleados de OpenAI. La primera les dio acceso al foro de la compañía y la segunda, un fallo en su sistema de identificación, les permitió utilizar ese acceso para hacerse con las cuentas de usuarios que habían iniciado sesión en el foro. A través de una de ellas pudieron utilizar servicios conectados, entre ellos GitHub, y llegar hasta el repositorio interno de OpenAI, donde la empresa almacena y gestiona código y otros archivos relacionados con sus productos. Para demostrar que el acceso era real sin necesidad de consultar información sensible, utilizaron el Codex de un empleado para crear una solicitud de cambios en el repositorio y después detuvieron las pruebas. «Informamos rápidamente de la vulnerabilidad a OpenAI y Discourse y colaboramos con ellos para coordinar la solución. Agradecemos su atención al detalle y la rápida resolución del problema. OpenAI también nos otorgó una recompensa de 6.500 dólares», apuntan desde la firma de seguridad. Las vulnerabilidades ya han sido corregidas. Efectivamente, Claude jugó un papel importante en la prueba. Los expertos de Hacktron utilizaron primero el modelo Claude Opus 4.8. Sin embargo, este sistema no fue capaz de desarrollar un ataque exitoso; algo que sí logró Opus 5, la siguiente versión lanzada por Anthropic, que fue capaz de preparar un ataque funcional en cuestión de horas. Después, los expertos utilizaron agentes de inteligencia artificial para automatizar parte de las pruebas y continuar avanzando en la investigación. Según Hacktron, este caso demuestra cómo la inteligencia artificial puede reducir el tiempo y los conocimientos necesarios para llevar a cabo ataques informáticos complejos. Los modelos pueden ayudar a analizar código, localizar fallos de seguridad y desarrollar las herramientas necesarias para aprovecharlos. «La IA está convirtiendo la experiencia especializada en capacidad de computación. El trabajo que antes requería un equipo con amplios recursos y meses de esfuerzo ahora se puede realizar en cuestión de días», sostienen los investigadores.

Related Articles