Publicado: septiembre 2, 2026, 7:28 am
Astra es el nuevo modelo de inteligencia artificial de OpenAI que ha demostrado unas capacidades en ciberseguridad que han llevado a la compañÃa a retrasar parte de su desarrollo y lanzamiento. Las pruebas realizadas han demostrado que puede detectar vulnerabilidades desconocidas y desarrollar métodos para explotarlas en sistemas protegidos sin supervisión humana, hasta alcanzar un nivel que la compañÃa considera crÃtico y que requiere reforzar sus medidas de seguridad antes de ampliar su acceso.
En este sentido, OpenAI ya habÃa advertido en una primera evaluación que Astra podÃa alcanzar este nivel de capacidad, pero decidió realizar nuevas pruebas antes de confirmar sus conclusiones. Ahora, tras recopilar más evidencias y analizar el comportamiento del modelo en diferentes escenarios, la compañÃa de Sam Altman considera en un comunicado oficial que Astra cumple con el umbral de capacidad crÃtica en ciberseguridad establecido en su ‘Marco de Preparación’.
Esto significa que, con las herramientas y el acceso necesarios, Astra puede encontrar vulnerabilidades de seguridad que todavÃa no han sido descubiertas y desarrollar métodos para explotarlas en distintos sistemas protegidos. Además, puede hacerlo sin que una persona tenga que supervisar cada uno de sus pasos.
Astra es capaz de explotar vulnerabilidades de seguridad
Las pruebas realizadas muestran hasta qué punto han avanzado las capacidades de Astra.
El modelo obtuvo una puntuación del 100% en ExploitBench, una prueba diseñada para medir la capacidad de desarrollar exploits a partir de vulnerabilidades conocidas. Además, OpenAI creó una evaluación interna con 20 vulnerabilidades de alta gravedad y, durante las pruebas, Astra llegó a descubrir y utilizar dos vulnerabilidades de dÃa cero como parte de una cadena de explotación. No obstante, la compañÃa asegura en un comunicado oficial que está trabajando para comunicar estos fallos a los responsables de los sistemas afectados.
Por otro lado, las evaluaciones realizadas por expertos también mostraron que Astra podÃa superar las protecciones de determinados entornos. En una de las pruebas, el modelo consiguió construir una cadena de ataque capaz de escapar del aislamiento de un navegador y ejecutar comandos en el equipo anfitrión. Y en otro escenario, identificó varias vulnerabilidades en un sistema operativo protegido y las combinó para conseguir elevar privilegios desde una cuenta sin permisos hasta el nivel de administrador.
OpenAI refuerza la seguridad de Astra
El descubrimiento de estas capacidades ha obligado a OpenAI a elevar sus medidas de seguridad antes de permitir un despliegue más amplio. Además, la compañÃa ha retrasado determinadas fases del desarrollo para crear controles destinados a impedir tanto que terceros utilicen Astra con fines maliciosos como que el propio modelo pueda realizar acciones no autorizadas.
Concretamente, entre las medidas adoptadas se encuentran entornos de desarrollo aislados, restricciones de acceso a redes y herramientas, una monitorización más intensa y un entrenamiento especÃfico para que Astra rechace solicitudes relacionadas con actividades cibernéticas dañinas. Asimismo, OpenAI ha establecido sistemas capaces de detectar y detener posibles acciones no autorizadas.
Cabe mencionar que la compañÃa tuvo en cuenta el incidente de seguridad sufrido por Hugging Face, aunque Astra no participó en él. OpenAI pausó durante dos semanas determinadas actividades de entrenamiento de sus modelos tras aquel episodio y posteriormente endureció los controles de aislamiento, monitorización y alineación.
El lanzamiento de Astra tendrá un acceso limitado
Por el momento, OpenAI no ha anunciado una fecha concreta para el lanzamiento de Astra, ya que seguirá trabajando en sus sistemas de seguridad antes de ampliar el acceso al modelo.
Cuando llegue al público, sus capacidades de ciberseguridad más avanzadas estarán inicialmente restringidas a un grupo de evaluadores. Posteriormente, OpenAI prevé ampliar su utilización defensiva mediante Daybreak Blue, un programa destinado a poner estas capacidades a disposición de determinados usuarios para ayudar a detectar y solucionar vulnerabilidades.
OpenAI sostiene que las nuevas medidas reducen suficientemente el riesgo como para permitir el lanzamiento de Astra, aunque reconoce que el desarrollo de modelos con capacidades cibernéticas tan avanzadas plantea nuevos riesgos que deberán seguir siendo evaluados.
