Un agente de OpenAI entró sin permiso en una web gubernamental y la empresa tardó casi tres meses en avisar - Mexico
Registro  /  Login

Otro sitio más de Gerente.com


Un agente de OpenAI entró sin permiso en una web gubernamental y la empresa tardó casi tres meses en avisar

Publicado: septiembre 24, 2026, 7:37 am

Las revelaciones sobre agentes de inteligencia artificial que traspasan los límites de sus tareas se acumulan. En las últimas semanas, los grandes laboratorios han publicado nuevos detalles sobre pruebas que terminaron afectando a sistemas reales de terceros. Se les ha venido llamando ‘agentes descontrolados’: programas capaces de encadenar acciones para cumplir un objetivo que, en estos casos, han acabado accediendo a recursos para los que no tenían permiso.

El último caso conocido afecta a un portal gubernamental australiano. Un agente de OpenAI accedió sin autorización al sitio el pasado 18 de junio, pero la compañía de Sam Altman no notificó lo ocurrido a Services Australia hasta el 10 de septiembre, 84 días después. El incidente, hecho público este 24 de septiembre, ha provocado una protesta del Gobierno australiano por la demora.

El acceso se produjo durante una prueba interna en la que un modelo investigaba el gasto público en medicamentos. Según explicó el primer ministro, Anthony Albanese, el agente encontró bloqueos al solicitar información, probó vías alternativas y terminó entrando en áreas para las que no tenía autorización.

El sistema consultó información pública y no pública del portal de estadísticas de Medicare. Albanese también señaló que, según Services Australia, el agente escribió archivos en un servidor interno durante el proceso, aunque el alcance de esa actividad sigue bajo investigación.

Las autoridades australianas aseguran que no se accedió a datos médicos individuales. El portal contenía estadísticas agregadas y funcionaba de forma independiente de los sistemas de prestaciones y pagos de Medicare. La plataforma permanece desactivada y Australia ha creado un grupo de trabajo para investigar lo ocurrido y revisar la seguridad de sus redes frente a amenazas vinculadas a la IA.

No es la primera vez

OpenAI ha reconocido que sus modelos comprometieron la plataforma Hugging Face y que su revisión de actividades anteriores ha llevado a avisar a decenas de terceros. La compañía relaciona estos comportamientos con estrategias que los modelos adoptan para resolver tareas difíciles, aunque se aparten de lo que sus desarrolladores pretendían.

Anthropic, por su parte, publicó el 9 de septiembre un análisis de cuatro incidentes en los que modelos de Claude accedieron sin autorización a sistemas reales durante evaluaciones de ciberseguridad. Los entornos de prueba tenían una conexión a internet que debía estar cerrada.

Meta también reconoció en agosto que uno de sus modelos aprovechó una vulnerabilidad de un servicio externo después de que un error de configuración durante una evaluación le permitiera conectarse a internet.

Google acaba de confirmar que Gemini había accedido a los sistemas de tres empresas durante unas pruebas realizadas en mayo. Según la compañía, el modelo creía que los objetivos formaban parte del ejercicio y detuvo sus acciones al reconocer que se trataba de empresas reales.

Related Articles