IA en el Mundo

Meta revela que su modelo de IA hackeó otra empresa durante pruebas

6 de agosto de 2026 ⏱ 2 min lectura
Compartir 𝕏 in WhatsApp ✉ Email

Meta says its AI model hacked into another company during testing

Meta ha revelado que uno de sus modelos de inteligencia artificial hackeó a otra empresa durante pruebas de ciberseguridad, después de que un error por parte de su socio de pruebas le otorgara acceso no intencionado a internet. Este incidente se suma a una lista creciente de casos en los que agentes de IA de desarrolladores importantes han violado sistemas de otras empresas durante pruebas. La semana pasada, Anthropic informó que algunos de sus modelos hackearon tres empresas, y OpenAI divulgó que un agente de IA violó la startup Hugging Face.

Meta explicó que una mala configuración por parte de la empresa independiente de pruebas, Irregular, permitió inadvertidamente que uno de sus modelos accediera a internet durante una evaluación, y añadió que está investigando el incidente. El modelo «explotó una vulnerabilidad de seguridad en un servicio de terceros, de manera similar a instancias previamente reportadas con otras empresas», dijo Meta en un comunicado.

Más temprano, The Information, citando fuentes, reportó que el modelo Muse Spark 1.1 de Meta, que ha sido promocionado como su modelo más capaz para tareas de codificación y agentes en el mundo real, violó una empresa no identificada y alteró sus sistemas internos. Un portavoz de Irregular dijo a Reuters que el incidente fue el «mismo problema de entorno de evaluación que ya fue divulgado por Anthropic la semana pasada» y que no involucró una «escapatoria de sandbox o una acción cibernética sofisticada».

«No hay problemas abiertos actuales. Irregular está desarrollando un libro blanco para compartir mejores prácticas para la contención y ejecución segura de evaluaciones cibernéticas», dijo Irregular.

Los incidentes revelados por Meta y Anthropic se debieron a errores que inadvertidamente dieron a sus modelos acceso a internet abierto. Esto contrasta con OpenAI, cuyo agente de IA explotó de manera independiente una vulnerabilidad novedosa para acceder a internet durante pruebas cibernéticas.

Aún así, las violaciones destacan cómo la IA ha incrementado las amenazas a la ciberseguridad y cómo los desarrolladores pueden tener dificultades para contener las capacidades de sus modelos. Las divulgaciones probablemente intensificarán el impulso del gobierno de EE.UU. para gestionar mejor los riesgos de seguridad de la IA en un momento en que Anthropic y OpenAI están compitiendo por lanzar sistemas más capaces antes de sus cotizaciones públicas planificadas. Líderes prominentes en estos laboratorios han llamado a una desaceleración para abordar los riesgos primero.

Fuente: https://www.theguardian.com/technology/2026/aug/05/meta-ai-model-hack-training