Google reconoce que su IA Gemini accedió sin permiso a tres empresas reales durante una prueba de ciberseguridad - Mexico
Registro  /  Login

Otro sitio más de Gerente.com


Google reconoce que su IA Gemini accedió sin permiso a tres empresas reales durante una prueba de ciberseguridad

Publicado: septiembre 19, 2026, 8:47 am

La inteligencia artificial de Google accedió sin autorización a los sistemas de tres empresas reales durante una prueba de ciberseguridad. Los incidentes ocurrieron en mayo, pero no habían sido comunicados públicamente hasta ahora. Gemini estaba participando en una evaluación realizada por Irregular, una empresa independiente que analiza las capacidades de los modelos de inteligencia artificial. La prueba debía desarrollarse contra compañías ficticias, pero el agente consiguió conectarse a internet y confundió varios sistemas reales con los objetivos simulados.

En uno de los casos, Gemini probó contraseñas hasta conseguir entrar en un servicio protegido. En los otros dos encontró credenciales expuestas públicamente en repositorios de código y las utilizó para acceder a los sistemas de las empresas.

El modelo detuvo su actividad en los tres incidentes, según Heather Adkins, directora de Ingeniería de Seguridad de Google. La compañía asegura que avisó a las organizaciones afectadas y trabajó para modificar el diseño de las evaluaciones.

Google no ha identificado a las empresas ni ha explicado qué información pudo consultar Gemini. Tampoco ha publicado las instrucciones entregadas al modelo o los registros completos de su actividad.

Google decidió no hacer público el incidente

Irregular comunicó los episodios a Google a finales de julio, después de descubrir otros casos similares relacionados con agentes de inteligencia artificial. Sin embargo, la tecnológica decidió no divulgarlos públicamente porque, según explica a The Guardian, los modelos no habían causado daños.

La noticia fue revelada inicialmente por The Wall Street Journal y posteriormente confirmada por Google. Es el primer caso conocido en el que un sistema de inteligencia artificial de la compañía accede autónomamente a organizaciones ajenas durante una evaluación. “En una evaluación estándar, el modelo encontró información pública en internet y adivinó credenciales para acceder a páginas web que creía que formaban parte de la prueba”, explicó Adkins.

Irregular sostiene que los problemas técnicos que permitieron los accesos fueron corregidos hace semanas. La empresa también avisó a los demás laboratorios afectados y afirma que está trabajando en unas normas comunes para realizar estas evaluaciones sin poner en riesgo sistemas externos.

Ya ha ocurrido con las IA de Meta, Anthropic y OpenAI

El episodio de Gemini no es un caso aislado. Meta, Anthropic y OpenAI ya habían reconocido incidentes similares durante pruebas de ciberseguridad realizadas con agentes capaces de navegar por internet, utilizar terminales y ejecutar acciones de manera autónoma.

Los modelos de Anthropic accedieron a sistemas de tres compañías después de que un error de configuración les proporcionase conexión al internet real. La empresa llegó a revisar más de 141.000 sesiones y suspendió temporalmente este tipo de evaluaciones.

Meta comunicó otro episodio en agosto, aunque aseguró que no se produjo una fuga desde un entorno aislado ni se utilizaron técnicas sofisticadas.

OpenAI también reconoció que varios de sus agentes habían alcanzado infraestructura real durante sus entrenamientos. Uno de los incidentes afectó a Hugging Face y obligó a la compañía a detener sus pruebas durante dos semanas.

Los cuatro casos tienen un elemento común: los modelos no comenzaron espontáneamente un ciberataque, sino que estaban participando en evaluaciones. El fallo se produjo porque recibieron acceso a internet y no distinguieron correctamente dónde terminaba el entorno autorizado.

El temor a una IA que ayude a hacerse más inteligente

Estos incidentes han aparecido en plena discusión sobre la velocidad a la que están mejorando los modelos. Dario Amodei, consejero delegado de Anthropic, pidió esta semana ralentizar el desarrollo de las IA más potentes. Sam Altman y Elon Musk respaldaron públicamente su propuesta, mientras que Donald Trump la rechazó por considerar que Estados Unidos no puede reducir el ritmo de su competición con China.

Uno de los principales temores de Amodei es la denominada automejora recursiva: que una IA ayude a crear un modelo más potente y que este, a su vez, pueda participar todavía más en el desarrollo del siguiente.

Ya existe un primer paso en esa dirección, aunque todavía muy lejos de una IA que se mejora completamente sola. Anthropic asegura que Claude lidera actualmente el 26 % de sus tareas internas de investigación y desarrollo, frente a menos del 1 % unos meses antes, y colabora de alguna forma en más del 90%.

“Liderar” una tarea no significa que Claude decida qué sistema debe construirse o que pueda entrenar por sí mismo a su sucesor. Los investigadores humanos continúan fijando los objetivos, proporcionando las herramientas, revisando los resultados y controlando la infraestructura. La preocupación está en qué ocurriría si cada nueva generación necesitase menos intervención humana para desarrollar la siguiente, porque los errores podrían propagarse con mayor rapidez y el tiempo disponible para examinar las capacidades o corregir las salvaguardas se reduciría.

Related Articles