Meta confirma que uno de sus modelos de IA atacó a una empresa real durante una prueba de ciberseguridad - Mexico
Registro  /  Login

Otro sitio más de Gerente.com


Meta confirma que uno de sus modelos de IA atacó a una empresa real durante una prueba de ciberseguridad

Publicado: agosto 6, 2026, 6:23 pm

En las últimas semanas, hemos presenciado que varios modelos de inteligencia artificial más avanzados de las grandes empresas del sector han sido los protagonistas de una serie de incidentes. En primer lugar, OpenAI, la compañía propietaria de ChatGPT, confirmó que varios de sus sistemas participaron en un ataque controlado contra la plataforma Hugging Face. Después, Anthropic reveló que algunos de sus modelos Claude lograron acceder sin permiso a tres organizaciones reales después de que un fallo en el entorno de pruebas les concediera acceso a Internet.

Ahora, ha sido Meta la que ha confirmado un caso parecido. La compañía de Zuckerberg ha reconocido que uno de sus modelos de inteligencia artificial (Meta AI) consiguió acceder a internet de forma accidental y terminó atacando a una empresa real durante una prueba de ciberseguridad. Así lo ha confirmado Ana Duck, directora de comunicación e innovación de Meta para Europa, Oriente Medio y África, en declaraciones a The Verge.

¿Qué es lo que ha ocurrido con la IA de Meta?

Según explicó la empresa y adelantó The Information, el problema se originó por un error de configuración de Irregular, la compañía independiente encargada de realizar esa evaluación. El fallo permitió que, sin querer, el modelo saliera del entorno aislado en el que tenía que permanecer y pudiera conectarse a internet. Ahí continuó ejecutando acciones hasta lograr un acceso no autorizado a una empresa real.

Meta ha comunicado que el modelo aprovechó una vulnerabilidad de seguridad de los servicios de terceros y el sistema implicado fue Muse Spark-1.1, un modelo que la empresa presenta como uno de los más avanzados para programación y agentes de IA capaces de actuar de forma autónoma. Eso sí, la identidad de la empresa afectada no se ha hecho pública. Por otra parte, Irregular ha asegurado a Reuters que se trató exactamente del mismo tipo de problema que sufrió Anthropic, descrito días antes.

Diferencia entre los incidentes

Han dejado claro que no hubo una fuga del entorno de pruebas ni un ciberataque especialmente sofisticado y anunció que está preparando un documento con las recomendaciones necesarias para mejorar la seguridad. Desde The Information aseguran que, a pesar de que el resultado fue parecido, hubo una diferencia importante entre los casos. Mientras que los incidentes de Meta y Anthropic se produjeron porque un error permitió que sus modelos accedieran a internet, OpenAI explicó que su agente encontró por sí solo una puerta para salir del entorno controlado durante las pruebas.

Como ya reflexionamos en las anteriores noticias relacionadas con estos modelos de IA, esto refleja que cada vez es más complicado controlar a unos sistemas de inteligencia artificial cada vez más autónomos, incluso cuando están siendo evaluados, presuntamente, en entornos diseñados para ser seguros.

Related Articles