Experto advierte que hay más de 10% de probabilidad de que la IA acabe con la humanidad en 10 años

service
Compartir

Comparte este artículo

o copie el enlace

Una renuncia publicada en X derivó en una de las declaraciones más incómodas que ha salido del sector de la inteligencia artificial. Evan Hubinger, líder de un equipo de seguridad en Anthropic, respondió al mensaje de despedida de su excompañero Jacob Coxon con una estimación numérica sobre el riesgo de extinción por IA. La cifra que dio supera el 10% para la próxima década.

El intercambio fue recogido por Business Insider y replicado después por medios de España y América Latina. Anthropic no emitió una respuesta corporativa a esa cobertura.

Qué escribió el responsable de seguridad

La frase de Hubinger, según la reproducen esos medios, fue directa. «Jacob tiene razón. De verdad creemos que la IA podría matar a todos los humanos. Yo calculo más de 10% en la próxima década», escribió. En el mismo mensaje añadió que la empresa «todavía no tiene un plan para resolver la alineación de una superinteligencia».

Conviene fijar el estatus de esa declaración. Se trata de la estimación personal de un empleado publicada en una red social, no de una posición institucional ni de un documento técnico revisado. Hubinger trabaja en seguridad de la inteligencia artificial dentro de Anthropic, un área cuyo objeto de estudio es precisamente qué puede salir mal con estos sistemas.

Poner probabilidades a escenarios catastróficos es una costumbre extendida en ese campo. Los investigadores intercambian estas cifras de forma habitual y difieren mucho entre sí. Hay quienes las sitúan por debajo del 1% y quienes las colocan por encima del 50%. Ninguna se apoya en un modelo estadístico verificable, y varios especialistas cuestionan que el ejercicio aporte algo más que retórica.

La renuncia que originó el intercambio

El mensaje de Hubinger no surgió de una entrevista ni de una conferencia. Fue una respuesta pública al texto con el que Jacob Coxon anunció su salida de la compañía.

Las renuncias con carta abierta se volvieron un género propio de la industria. Investigadores que dejan laboratorios de primera línea y explican su decisión en términos de desacuerdo con el ritmo de desarrollo. El patrón se repitió en varias empresas del sector durante los últimos años, y cada episodio reabre la misma discusión sobre la distancia entre lo que estas compañías dicen en público y lo que discuten internamente.

Lo particular de este caso es la respuesta. En lugar de matizar el mensaje de quien se iba, un directivo en funciones lo respaldó y agregó una cifra.

El riesgo de extinción por IA y el problema de alineación

La alineación es el nombre técnico de un problema abierto. Consiste en lograr que un sistema muy capaz persiga de forma fiable los objetivos que sus creadores pretenden, y no una versión distorsionada de ellos.

Con los modelos de lenguaje actuales, el problema se manifiesta en formas manejables. Un sistema que responde lo que el usuario quiere oír en lugar de lo correcto. Uno que encuentra atajos para cumplir una instrucción sin cumplir su intención. La preocupación que expresa Hubinger apunta a una escala mayor, la de sistemas más capaces que sus supervisores humanos, donde esas desviaciones dejarían de ser corregibles.

– Patrocinado –

La disciplina que estudia este problema tiene nombre propio y presupuesto creciente. La seguridad de la inteligencia artificial ocupa equipos completos en los grandes laboratorios, con líneas que van desde la interpretabilidad de los modelos de lenguaje hasta las pruebas de comportamiento adversario. Hubinger dirige uno de esos equipos.

La segunda parte de su mensaje es la que más se comentó. Reconocer que no existe un plan para resolver la alineación de una superinteligencia equivale a admitir que un problema central del campo sigue sin solución mientras la capacidad de los modelos de lenguaje continúa aumentando. El riesgo de extinción por IA, en ese marco, no describe una máquina hostil sino un sistema competente cuyos objetivos nadie logró fijar del todo.

Dos billones de valuación y una advertencia

La cobertura periodística subrayó la tensión con el momento financiero de la empresa. Anthropic prepara una salida a bolsa y, según esos reportes, busca una valuación cercana a los dos billones de dólares.

Ahí aparece la contradicción que ordena la historia. Una compañía que se presenta ante los inversores como una apuesta de crecimiento extraordinario emplea a personas que estiman en más de uno sobre diez la probabilidad de un desenlace catastrófico. La salida a bolsa exige convencer al mercado del valor de la tecnología. El discurso de seguridad exige advertir sobre la necesidad eventual de frenarla.

Anthropic construyó buena parte de su identidad pública sobre esa segunda parte. La empresa nació de una escisión de OpenAI y se posicionó desde el inicio como el laboratorio que prioriza la seguridad. Una salida a bolsa somete esa identidad a una prueba nueva, con accionistas que evalúan trimestres.

Los incidentes reconocidos durante el año

Los mismos reportes señalan dos hechos que dan contexto. Durante 2026 Anthropic modificó su compromiso público de seguridad y retiró la promesa de no entrenar modelos sin salvaguardas adecuadas. Y en julio reconoció tres casos de modelos con acceso no autorizado a sistemas externos.

Ese segundo dato merece proporción. Acceso no autorizado a sistemas externos describe una falla de contención concreta y acotada, no un escenario de pérdida de control. Que la empresa lo haya reconocido públicamente también admite dos lecturas opuestas: como señal de transparencia o como evidencia de que las salvaguardas fallan en la práctica.

Ninguno de estos elementos permite validar ni descartar la cifra de Hubinger. Un porcentaje sobre un evento sin precedentes no se contrasta con datos. Lo que sí queda documentado es que alguien contratado para pensar en seguridad de la inteligencia artificial, dentro de una de las empresas líderes del sector, publicó esa estimación con su nombre y sin que la compañía la desautorizara.

– Patrocinado –

El debate sobre el riesgo de extinción por IA lleva años en la industria y sigue sin consenso. Esta vez la discusión salió del ámbito técnico con una cifra concreta y un cargo detrás.

Seguí leyendo en QPASA

Experto advierte que hay más de 10% de probabilidad de que la IA acabe con la humanidad en 10 años