Actualidad
Meta confirmó que su IA Muse Spark 1.1 accedió sin autorización a sistemas de una empresa real
Una falla en el entorno de pruebas permitió que el modelo se conectara a internet durante una evaluación de ciberseguridad. Meta aseguró que no se trató de una fuga deliberada del sistema.
Meta confirmó que uno de sus modelos de inteligencia artificial accedió sin autorización a sistemas de una empresa real mientras participaba de una prueba de ciberseguridad. El episodio ocurrió luego de que un error de configuración permitiera al sistema conectarse a internet desde un entorno que debía permanecer aislado.
El modelo involucrado fue Muse Spark 1.1, desarrollado por Meta Superintelligence Labs y orientado, entre otras tareas, a programación y resolución de problemas técnicos. La compañía afectada por el incidente no fue identificada públicamente.
La evaluación estaba a cargo de Irregular, una firma independiente especializada en analizar las capacidades de ciberseguridad de modelos avanzados de inteligencia artificial. La empresa trabaja con Meta en pruebas destinadas a medir cómo estos sistemas detectan y aprovechan vulnerabilidades.
Una falla permitió que la IA llegara a internet
El entorno utilizado durante la evaluación debía impedir cualquier conexión con sistemas externos. Sin embargo, una configuración incorrecta habilitó accidentalmente el acceso a internet.
Una vez conectado, Muse Spark 1.1 aprovechó una vulnerabilidad presente en un servicio de terceros y terminó interactuando con infraestructura perteneciente a una empresa real.
Irregular aclaró que el episodio no fue consecuencia de una fuga del entorno de pruebas ni de una técnica sofisticada utilizada para romper el aislamiento. La firma atribuyó lo ocurrido a la configuración de la infraestructura utilizada durante la evaluación.
Meta, por su parte, inició una investigación y prevé publicar una revisión detallada del incidente una vez que termine de establecer lo ocurrido. Irregular también trabaja en recomendaciones para reforzar la seguridad de este tipo de pruebas.
Meta se suma a otros incidentes con modelos de IA
El caso se conoció después de episodios similares protagonizados por sistemas desarrollados por OpenAI y Anthropic, aunque las circunstancias técnicas no fueron idénticas.
Anthropic informó recientemente que algunos modelos de Claude llegaron a sistemas externos durante evaluaciones de ciberseguridad debido a problemas vinculados con los entornos utilizados para las pruebas.
En otro caso, un modelo de OpenAI logró acceder a infraestructura de Hugging Face mientras participaba de una evaluación. Ese episodio abrió interrogantes sobre los mecanismos utilizados para mantener aislados a agentes con capacidades avanzadas de programación y ciberseguridad.
Qué se sabe sobre Muse Spark 1.1
Irregular había publicado en julio una evaluación sobre Muse Spark 1.1. Según sus resultados, el modelo mostró un rendimiento elevado en tareas específicas de seguridad informática, con tasas de éxito de al menos 75% en algunas pruebas, aunque presentó mayores dificultades para completar cadenas de ataque largas y de varias etapas.
El nuevo incidente vuelve a poner el foco en los controles de seguridad utilizados para evaluar modelos de inteligencia artificial capaces de ejecutar acciones de forma autónoma. En este caso, las empresas involucradas sostienen que la causa estuvo en el entorno de pruebas y no en una decisión deliberada del modelo de escapar de sus restricciones.
