Investigador de Anthropic advierte sobre el riesgo existencial de la IA para la humanidad
Anthropic researcher believes more than 10% chance AI 'could kill all humans'
Un destacado investigador de seguridad de Anthropic ha lanzado una advertencia alarmante sobre el rápido avance de la inteligencia artificial (IA), afirmando que existe más de un 10% de probabilidad de que esta tecnología «pueda acabar con todos los humanos» en la próxima década. Evan Hubinger expresó su preocupación en una publicación en X, señalando que aunque el riesgo actual de los modelos existentes es «bajo», teme que la tecnología pueda desarrollarse y mejorarse a sí misma hasta el punto de representar una amenaza existencial para la humanidad.
Estas declaraciones se suman a una serie de advertencias cada vez más severas sobre la IA, con el debate trasladándose de si realmente representa un riesgo a cuán grande podría ser ese riesgo. La intervención de Hubinger fue una respuesta a otra publicación en X de Jacob Coxon, un investigador de IA que recientemente renunció a Anthropic y anteriormente trabajó en OpenAI. Coxon criticó a ambas compañías por no actuar de manera responsable, afirmando que «pronto serán sistemas sobrehumanos capaces de hackear cualquier cosa, revolucionar cualquier campo de la noche a la mañana y adquirir poder y recursos reales».
Dame Wendy Hall, una científica informática que asesora a la ONU sobre IA, expresó su «sorpresa» por las publicaciones en redes sociales de Hubinger y Coxon, sugiriendo que parte de esto podría ser «PR y marketing» mientras Anthropic y OpenAI se preparan para sus esperados debuts en el mercado de valores. Sin embargo, también instó a los inversores a no invertir en estas compañías si ese es su sistema de valores.
La renuncia de Coxon motivó a Darren Jones, ex secretario jefe del Tesoro y secretario jefe de Sir Keir Starmer, a escribir una carta abierta al Primer Ministro Andy Burnham pidiendo un nuevo tratado multinacional para el desarrollo seguro de la IA. Jones enfatizó la necesidad de que los gobiernos colaboren para definir cómo debería ser un tratado basado en el desarrollo de superinteligencia.
En un informe de seguridad de agosto, Anthropic reconoció un bajo riesgo de que sus modelos se desalineen con los deseos de una organización poderosa hipotética, lo que podría llevar a la explotación o manipulación de sus sistemas. Sin embargo, también admitió que su confianza en esta evaluación era menor que antes, observando «signos tempranos de potencial aceleración».
Figuras destacadas en el campo de la IA han estado advirtiendo sobre la amenaza que representa la tecnología durante años, con los jefes de OpenAI, Google Deepmind y Anthropic haciendo lo mismo en 2023. Sin embargo, estas advertencias se han vuelto mucho más severas en las últimas semanas, a medida que surgen evidencias de que las empresas podrían estar teniendo dificultades para controlar la IA.
¿Te ha interesado esta noticia?
Recibe cada mañana el resumen de IA y sociedad directo en tu email.
Suscríbete gratis →