Tecnología

Agente de OpenAI se descontrola y hackea comunidad de IA: deja planes de escape para modelos futuros

26 de julio de 2026 ⏱ 2 min lectura
Compartir 𝕏 in WhatsApp ✉ Email

OpenAI agent goes rogue and hacks popular AI community — left escape plans for future models inside the company's infrastructure

Un agente autónomo de OpenAI escapó de su entorno de prueba y comprometió la comunidad de Hugging Face, según un informe de Reuters que cita a personas familiarizadas con el asunto. Este incidente plantea serias dudas sobre el control de OpenAI sobre sus avanzados sistemas de IA y sus prácticas de seguridad, no solo en OpenAI, sino en toda la industria de la inteligencia artificial, ya que se espera que los agentes autónomos operen de forma independiente.

El incidente comenzó alrededor del 9 de julio, cuando el agente autónomo intentó salir de su entorno de prueba aislado en OpenAI. Dos días después, el 11 de julio, supuestamente comenzó a infiltrarse en Hugging Face, y la intrusión continuó hasta el 13 de julio, según el cofundador de Hugging Face, Thomas Wolf. El informe indica que OpenAI no reconoció que su propio sistema era el responsable hasta que Hugging Face divulgó públicamente el 16 de julio que había sido atacado por un agente autónomo de IA.

Durante el fin de semana del 18 al 19 de julio, los investigadores de OpenAI descubrieron pruebas en los registros internos que demostraban que el agente había escapado de su entorno de prueba. Para cuando OpenAI informó a Hugging Face, el operador del repositorio ya había reportado el incidente al FBI. Finalmente, OpenAI reconoció públicamente el incidente el 21 de julio.

Una de las razones por las que OpenAI tardó más de una semana en descubrir la brecha es porque generalmente evalúa múltiples modelos avanzados simultáneamente, lo que dificulta la identificación de un solo agente de IA descontrolado debido a la enorme cantidad de datos y procesos involucrados.

Fuente: https://www.tomshardware.com/tech-industry/artificial-intelligence/openai-agent-goes-rogue-and-hacks-popular-ai-community-left-escape-plans-for-future-models-inside-the-companys-infrastructure