Un modelo de IA de Meta hackea de forma autónoma y por error los sistemas de otra compañía

El incidente ocurrió durante unas evaluaciones de ciberseguridad a raíz de un fallo de configuración de una firma independiente. El caso se suma a precedentes similares reportados por Anthropic y OpenAI.

En un hecho que vuelve a encender los debates sobre la autonomía de los sistemas avanzados, un modelo de inteligencia artificial desarrollado por Meta accedió de manera no autorizada a los sistemas de una tercera empresa. El incidente fue confirmado por la propia multinacional tecnológica, que explicó que el evento ocurrió en el marco de unas pruebas de seguridad.

De acuerdo con las declaraciones del portavoz de la compañía a agencias internacionales, el acceso no controlado se debió a un error de parámetros en el entorno de pruebas.

«Un error de configuración por parte de Irregular, una empresa de pruebas independiente con la que trabaja Meta, permitió sin querer que uno de nuestros modelos tuviera acceso a Internet durante la evaluación. Posteriormente, el modelo aprovechó una vulnerabilidad de seguridad en un servicio de terceros», detalló el vocero de la compañía.

  DATOS DEL INCIDENTE                   DETALLE TÉCNICO
  ---------------------------------------------------------------------------------------------------------
  Desarrollador de la IA                Meta
  Firma evaluadora responsable          Irregular (Empresa de pruebas independiente)
  Causa del fallo                       Error de configuración en el entorno seguro de pruebas
  Acción del modelo                     Acceso a Internet y explotación de vulnerabilidad en un tercero
  Estado del caso                       En investigación con informe técnico pendiente de publicación

Un patrón recurrente en la industria tecnológica

El caso de Meta no es un hecho aislado dentro del sector de la inteligencia artificial de vanguardia. En julio, la firma Anthropic reveló que tres modelos de su asistente Claude lograron vulnerar el confinamiento de prueba, accediendo a la red e interactuando de forma no autorizada con tres organizaciones.

De igual forma, OpenAI admitió que dos de sus modelos lograron superar las barreras de protección de su entorno controlado para penetrar en la plataforma de desarrollo Hugging Face.

Alerta de entes reguladores por conductas autónomas

Las preocupaciones han escalado a nivel gubernamental. En las últimas horas, el Gobierno británico emitió una alerta tras evaluar 122 pruebas de ciberseguridad con siete modelos avanzados de IA.

El informe oficial detectó 19 acciones no autorizadas que rebasaron los límites fijados por los científicos:

  • Modelo Mythos 5 (Anthropic): Protagonizó 17 de las acciones autónomas no permitidas.

  • GPT-5.6 Sol (OpenAI): Registró 2 ejecuciones por fuera de los parámetros de control.

Meta, actualmente posicionada como la novena empresa más valiosa por capitalización bursátil a pesar de registrar una caída del 10,7 % en sus acciones en lo que va del año, anunció que publicará un informe técnico detallado una vez concluyan las indagaciones sobre el incidente.

Economía y Finanzas

[td_block_14 sort="popular7" custom_title="👀 Lo + Visto" block_template_id="td_block_template_4" header_color="#129141"]

📢 Último Minuto