La empresa Meta AI informó este jueves 6 de agosto que uno de sus modelos de inteligencia artificial ingresó a internet por su propia cuenta y hackeó los sistemas de otra compañía por error. La acción se cometió mientras el modelo realizaba pruebas de ciberseguridad. Este caso sucede después de que OpenAI y Anthropic, en las últimas semanas, también reportaron que sus modelos de IA fueron más allá de las instrucciones humanas.
Se trata del modelo Muse Spark 1.1, lanzado recientemente, que violó la seguridad de los sistemas de una empresa de terceros. Hasta el momento no se tiene información sobre la identidad de dicha compañía. Meta señaló que la IA tuvo acceso a internet después de un error en la configuración del proceso de prueba.
“Una mala configuración por parte de Irregular, una empresa de pruebas independiente que utiliza Meta, permitió que uno de nuestros modelos tuviera acceso a internet durante la evaluación”, señaló Andy Stone, portavoz de Meta.
Stone explicó que el modelo de IA aprovechó una vulnerabilidad de seguridad de la otra entidad, derivada de la configuración. “De forma similar a lo ocurrido en casos ya denunciados anteriormente con otras empresas”, dijo Stone en referencia a los casos de OpenAI y Anthropic.
Meta aseguró que ya se encuentra investigando el incidente que involucró a los sistemas de otra compañía y señaló que en los próximos días emitirá un informe para esclarecer lo ocurrido; sin embargo, esto se dará una vez que hayan finalizado las investigaciones.
Por su parte, Irregular confirmó que el incidente tuvo origen en el mismo problema de entorno de evaluación que Anthropic reportó. También señaló que está desarrollando un documento técnico sobre cuáles son las mejores prácticas para la contención y realización de evaluaciones de ciberseguridad.
Irregular es una empresa de seguridad en materia de inteligencia artificial que se dedica a realizar pruebas y evaluaciones de ciberseguridad para grandes desarrolladores tecnológicos. En los últimos días ha sido tema de conversación al estar relacionada con los errores en pruebas de OpenAI, Anthropic y ahora Meta.
Aunque ninguno de los tres casos implicó una evasión maliciosa, los hackeos a empresas externas han elevado las preocupaciones acerca de los modelos de inteligencia artificial que podrían actuar de forma autónoma.