La advertencia lanzada por Jacob Coxon tras abandonar Anthropic ha vuelto a colocar una palabra hasta hace poco reservada a los círculos más especializados en el centro del debate tecnológico: superinteligencia artificial. El antiguo investigador de Anthropic y OpenAI sostiene que la carrera entre los grandes laboratorios de inteligencia artificial está entrando en una fase crítica y que los próximos años podrían resultar decisivos. Su mensaje es extremo, pero la preocupación que existe detrás de él ya no pertenece únicamente a quienes imaginan escenarios apocalípticos.
La superinteligencia artificial no existe actualmente. El concepto describe, de manera general, un sistema capaz de superar ampliamente a los mejores seres humanos en prácticamente todas las tareas intelectuales relevantes: investigación científica, programación, estrategia, razonamiento o resolución de problemas. Sería un salto todavía mayor que la denominada inteligencia artificial general o AGI, cuyo significado tampoco cuenta con una definición universalmente aceptada.
De una IA que responde a una IA capaz de actuar

El temor alrededor de la superinteligencia artificial no nace simplemente de imaginar una versión mucho más potente de los actuales asistentes conversacionales. La preocupación está relacionada con el desarrollo de agentes capaces de actuar durante periodos cada vez mayores, utilizar herramientas, escribir programas, navegar por sistemas informáticos y completar objetivos con una supervisión humana progresivamente menor.
El International AI Safety Report 2026, uno de los principales documentos internacionales dedicados a evaluar estos riesgos, establece una distinción fundamental: los sistemas actuales todavía no poseen las capacidades necesarias para provocar una auténtica pérdida de control. Sin embargo, el informe también señala avances en ámbitos relacionados con ese peligro, como la autonomía, la planificación o la capacidad de algunos modelos para reconocer cuándo están siendo evaluados y encontrar fallos en determinadas pruebas.
Eso explica por qué buena parte del debate sobre la superinteligencia artificial mira menos al presente que a la velocidad de la evolución tecnológica. Anthropic ha reconocido que sus propias inteligencias artificiales participan cada vez más en el desarrollo de nuevos sistemas. La compañía denomina “mejora recursiva” al hipotético punto en el que una IA pudiera diseñar y desarrollar autónomamente una sucesora superior, que a su vez contribuyera a crear otra todavía más avanzada.
Ese escenario todavía no se ha producido y tampoco está demostrado que vaya a producirse. Pero plantea una de las grandes incógnitas del sector: qué ocurriría si la inteligencia artificial comenzara a acelerar de forma significativa el propio progreso de la inteligencia artificial.
Jacob Coxon y el miedo a perder el control

Ahí se sitúa precisamente la advertencia de Jacob Coxon. Tras trabajar durante tres años entre OpenAI y Anthropic, el investigador abandonó esta última compañía denunciando que la competición por construir sistemas cada vez más avanzados podía estar relegando la seguridad. Coxon considera que existe el riesgo de que una carrera entre laboratorios estadounidenses y competidores internacionales termine empujando a todos ellos a avanzar más rápido de lo que permiten los mecanismos de control.
Algunos investigadores comparten una preocupación semejante. Evan Hubinger, investigador de alineamiento de Anthropic, llegó a situar por encima del 10% su estimación personal sobre la posibilidad de una catástrofe existencial provocada por la IA durante la próxima década. Ese porcentaje no representa un consenso científico ni una probabilidad calculada empíricamente: es una valoración personal ante un fenómeno para el que no existe ningún precedente histórico comparable.
El problema técnico que está detrás del debate sobre la superinteligencia artificial recibe el nombre de “alineamiento”. Consiste, simplificando, en conseguir que sistemas extremadamente capaces persigan realmente los objetivos que deseamos y continúen haciéndolo incluso cuando tengan mucha más autonomía. Una IA no necesitaría desarrollar odio, miedo o ambición para resultar peligrosa. Bastaría con que encontrase métodos indeseados para cumplir un objetivo mal especificado.
El miedo a la IA ya ha llegado a la sociedad
Lo que sí puede medirse con bastante más precisión es la inquietud social. El AI Index 2026 de la Universidad de Stanford refleja una paradoja significativa: el 59% de los encuestados a escala mundial considera que los productos de inteligencia artificial ofrecen más ventajas que inconvenientes, pero al mismo tiempo un 52% reconoce sentirse nervioso ante esta tecnología.
En Estados Unidos, Pew Research Center detecta una evolución todavía más marcada. En 2021, el 37% de los adultos se declaraba más preocupado que entusiasmado por el avance de la inteligencia artificial. En 2026 la cifra alcanza ya el 52%. Ipsos observa un fenómeno parecido a escala internacional: entusiasmo y preocupación prácticamente conviven al mismo nivel, mientras dos de cada tres encuestados esperan que la IA tenga todavía más impacto sobre sus vidas durante los próximos tres a cinco años.
El futuro inmediato probablemente no se parecerá a Terminator

La superinteligencia artificial sigue siendo, por tanto, una posibilidad futura y no una realidad presente. A corto plazo, el cambio más importante probablemente será mucho menos cinematográfico: sistemas capaces de asumir una parte creciente del trabajo intelectual, automatizar procesos, programar, investigar y actuar mediante herramientas digitales con una autonomía cada vez mayor.
Ese proceso puede generar enormes beneficios en ciencia, medicina, educación o productividad, pero también abre interrogantes sobre empleo, ciberseguridad, desinformación y concentración del poder tecnológico. El propio International AI Safety Report advierte de que existe una enorme incertidumbre sobre las capacidades que tendrán los modelos más avanzados dentro de apenas unos años.
Ahí reside probablemente la verdadera razón del miedo actual. No sabemos si la superinteligencia artificial aparecerá dentro de cinco años, dentro de varias décadas o nunca en los términos que hoy imaginamos. Lo que sí sabemos es que la inteligencia artificial está adquiriendo capacidades con enorme rapidez mientras gobiernos, empresas y científicos todavía discuten cuáles deben ser sus límites. La cuestión ya no es únicamente cuánto podrán llegar a pensar estas máquinas, sino cuánto estaremos dispuestos a permitirles hacer antes de estar seguros de que seguimos conservando el control.

