Experto de Anthropic estima en más de 10% el riesgo de que la IA acabe con la humanidad en la próxima década

service
Compartir

Comparte este artículo

o copie el enlace

Los sistemas de inteligencia artificial (IA) podrían “acabar con todos los humanos”. Esta es la creencia de Evan Hubinger, responsable de la ciencia de alineación en Anthropic, quien estima que este escenario catastrófico tiene más de 10% de posibilidades de ocurrir en algún punto de la próxima década.

La declaración se produjo después de que Jacob Coxon renunciara a su cargo como investigador en la misma empresa, argumentando que los desarrolladores de esta tecnología “están corriendo directamente hacia una superinteligencia automejorable y apostando con nuestras vidas. Las personas que están construyendo IA creen sinceramente que esta podría matarnos a todos para finales de la década. Esto no es un truco de marketing”.


Cerebro metálico

Nadie sabe lo que pasará con la IA y los verdaderos alcances que puede tener el desarrollo avanzado de esta tecnología.


Coxon, quien antes de colaborar en Anthropic formó parte del equipo de OpenAI, añadió que ninguna de estas empresas actúa de manera responsable en el desarrollo de sistemas de IA con capacidades avanzadas. “Ninguna otra actividad humana representa este nivel de peligro. Pronto serán sistemas sobrehumanos capaces de hackear cualquier cosa, revolucionar cualquier campo de la noche a la mañana y adquirir poder y recursos reales. Todos hemos presenciado el progreso en cada uno de estos dominios, y el progreso no está desacelerando”, advirtió.

Las preocupaciones sobre los riesgos existenciales de la IA no son nuevas. Sin embargo, ahora están en su máximo apogeo después de los avances presentados por las principales empresas del sector que, a decir de algunos especialistas, están acortando la brecha para alcanzar la superinteligencia artificial.

En teoría, en esta fase, la IA tendría capacidades de razonamiento y cognitivas para realizar tareas de manera autónoma, con un rendimiento igual o superior al que alcanzan las mentes humanas. El desarrollo de estos sistemas es considerado altamente riesgoso ante la falta de salvaguardas y regulaciones que limiten su uso abusivo.

Hasta ahora, no se tiene registro de ningún sistema que cumpla con estas características. No obstante, desarrollos como GPT-6 Astra de OpenAI, así como Fable 5.1 y Mythos 5.1 de Anthropic, están redefiniendo los criterios sobre los cuales se miden las amenazas relacionadas con el avance de la IA.

IA: una tecnología aún incomprendida que ya representa una amenza

A principios de este mes, Jakub Pachocki, científico jefe de OpenAI, sugirió que medir estos riesgos con base en la capacidad de los sistemas para igualar la inteligencia humana podría ser un grave error que “exige extrema precaución”. A su juicio, “la IA no necesita igualar ni superar todas las capacidades humanas; solo necesita superar suficientes. Y a medida que continúa superando a los humanos en más y más ámbitos, resulta cada vez más difícil comprender con exactitud su capacidad”.

Hace unos meses, cuando Anthropic presentó la primera versión de Mythos, aseguró que el modelo supera las capacidades humanas en tareas de ciberseguridad y hacking autónomo. Esta semana, OpenAI presentó una posible solución generada por IA para uno de los siete Problemas del Milenio, desafíos que el Clay Mathematics Institute identifica como los problemas matemáticos más difíciles sin solución y de los cuales la humanidad solo ha podido resolver uno.

Los especialistas indican que la amenaza no radica en el desarrollo de modelos de IA con capacidades cada vez más avanzadas, sino en que estos avances están ocurriendo en entornos con pocas regulaciones y sin las medidas de seguridad necesarias, que en la práctica no reconocen la naturaleza intrínseca de esta tecnología.

Experto de Anthropic estima en más de 10% el riesgo de que la IA acabe con la humanidad en la próxima década