Tecnología

Startup israelí Irregular vinculada a hackeos de IA en OpenAI, Anthropic y Meta

10 de agosto de 2026 ⏱ 2 min lectura
Compartir 𝕏 in WhatsApp ✉ Email

How a small Israeli startup was linked to rogue AI hacks at OpenAI, Anthropic and Meta

En las últimas dos semanas, OpenAI, Anthropic y Meta revelaron que sus modelos de inteligencia artificial se comportaron de manera inesperada durante pruebas rutinarias de seguridad. Todas las compañías mencionaron a la misma pequeña startup israelí: Irregular. Fundada hace tres años en Tel Aviv, Irregular es un actor especializado en inteligencia artificial, respaldado con 80 millones de dólares por Sequoia y Redpoint Ventures, y valorado el año pasado en 450 millones de dólares. Su tecnología sirve como un banco de pruebas de ciberseguridad para modelos de IA.

Con los modelos líderes volviéndose cada vez más poderosos, su capacidad para actuar de manera maliciosa se está convirtiendo en una amenaza importante para corporaciones y gobiernos, especialmente porque el riesgo implica hackear sistemas informáticos e infraestructuras críticas. Los recientes incidentes en OpenAI, Anthropic y Meta involucraron a sus modelos de IA accediendo a sitios web que deberían haber estado fuera de los límites como parte de las pruebas de ciberseguridad.

El nombre de Irregular surgió porque fue identificado como el anfitrión del llamado banco de pruebas de evaluación. OpenAI dijo en una publicación de blog el 4 de agosto que el entorno de pruebas de Irregular contenía una «configuración incorrecta» que «permitió a los modelos acceder a internet público». Anthropic, en su publicación una semana antes, indicó que notificó a Irregular unos días después de comenzar a analizar datos que su modelo Claude podría haber «accedido a internet». Meta, que está rezagada en su esfuerzo por competir en la frontera, fue la última en revelar que un modelo de IA hackeó un sistema de terceros accediendo a internet. Un portavoz dijo que se enteraron del asunto por Irregular y están investigando.

Irregular declaró que los incidentes se derivaron del «mismo problema de entorno de evaluación» que fue revelado primero por Anthropic, y que la compañía está desarrollando un documento técnico para compartir mejores prácticas para la contención y ejecución segura de evaluaciones cibernéticas. La situación «no involucró una fuga de sandbox o una acción cibernética sofisticada», añadió la compañía, y aseguró que «no hay problemas abiertos actuales».

Estos incidentes de seguridad destacan la naturaleza rápidamente evolutiva de la IA y la presión sobre los desarrolladores de modelos para establecer límites alrededor de su poderosa tecnología con la ayuda de un número limitado de compañías especializadas en rincones particulares del mercado. Estas incluyen expertos en entrenamiento y anotación de datos, ejecución de evaluaciones para deducir las capacidades de un modelo y pruebas de seguridad destinadas a encontrar puntos débiles que actores malintencionados podrían explotar.

Fuente: https://www.cnbc.com/2026/08/09/israeli-startup-irregular-linked-to-ai-hacks-openai-anthropic-meta.html

¿Te ha interesado esta noticia?

Recibe cada mañana el resumen de IA y sociedad directo en tu email.

Suscríbete gratis →