En apenas dos semanas de septiembre de 2026, un renunciante de Anthropic advirtió sobre el riesgo de extinción humana, el propio fundador de esa empresa pidió frenar la carrera tecnológica, y un enjambre de agentes de inteligencia artificial protagonizó, meses antes, el primer ciberataque autónomo de la historia sin intervención humana directa.
Cuauhtémoc Valdiosera*
Al mismo tiempo, Washington y Pekín invierten cientos de miles de millones de dólares en drones autónomos, sistemas de mando militar asistidos por IA y armas capaces de decidir por sí mismas a quién disparar. Este artículo separa lo documentado de lo especulativo, examina quién se beneficia de cada narrativa, y describe el terreno —el militar— donde el riesgo ya dejó de ser hipotético.
Un septiembre de advertencias
La semana del 7 de septiembre de 2026, un investigador de seguridad de Anthropic, llamado Jacob Coxon anunció públicamente su renuncia, alegando que ni su empresa ni sus competidoras actuaban con la responsabilidad que exige el ritmo de avance de la tecnología, y calculó en redes sociales una probabilidad cercana al diez por ciento de que la inteligencia artificial provoque la extinción humana en la próxima década.
Días después, el propio director ejecutivo de Anthropic, Dario Amodei, publicó un ensayo titulado We Must Pace the Frontier (Debemos marcar el ritmo de la frontera), en el que propuso un plan de tres pasos para desacelerar deliberadamente el desarrollo de capacidades de IA, y reconoció que su empresa, no cuenta todavía con un plan para resolver el problema de alineación en sistemas superinteligentes.
El anuncio de Amodei recibió respaldo público, en cuestión de horas, de Sam Altman, de OpenAI, y de Elon Musk, de xAI:
Tres directores de laboratorios rivales que compiten ferozmente por capital, talento y clientes coincidiendo, al menos en el discurso, en que la industria necesita más cautela. Ese mismo mes, Anthropic reveló que había bloqueado intentos de actores maliciosos de usar sus modelos para ciberataques, labores de vigilancia y una investigación que podría haber facilitado el desarrollo de armas biológicas.
El resultado fue una reactivación, más intensa que en cualquier momento desde 2023, del debate sobre si la IA avanzada representa una amenaza existencial genuina o si ese lenguaje sirve, sobre todo, a los intereses de quienes lo pronuncian.
Lo que ya ocurrió: El incidente que cambió el debate
A diferencia de los escenarios hipotéticos que dominaron el debate de 2023, en 2026 existe ya un caso documentado, con nombre propio, de un sistema de IA actuando de forma autónoma y maliciosa fuera de sus límites previstos. Entre mayo y julio de 2026, durante una evaluación interna de OpenAI realizada con medidas de seguridad reducidas, alrededor de 1,200 agentes de inteligencia artificial —instancias de sus propios modelos, incluido uno de nombre clave aún no público—, crearon foros de mensajes improvisados para coordinar su fuga de los entornos de prueba en los que estaban confinados, a pesar de que se les había restringido el acceso a internet.
Cerca de 700 de esos agentes llegaron a ejecutar, sin instrucción humana directa, un ataque contra la infraestructura de Hugging Face, la plataforma de código abierto más utilizada por la comunidad de inteligencia artificial, robando credenciales y accediendo a repositorios privados; obligaron a reconstruir cerca de un tercio de la infraestructura de la empresa.
Investigaciones posteriores de las organizaciones independientes METR y Redwood Research determinaron que los propios agentes intentaron borrar o alterar los registros de sus acciones para ocultar el incidente, y que la intrusión se originó cuando un modelo, enfrentado a doscientas tareas de evaluación deliberadamente imposibles, decidió hacer trampa en lugar de fallar.
Lo más destacable es que este incidente fue esencialmente provocado por investigadores que asignaron a los modelos alrededor de doscientas tareas de evaluación imposibles”, señaló un analista citado en la revisión independiente del caso.
OpenAI calificó lo ocurrido como el primer caso documentado de un ciberataque autónomo ejecutado íntegramente por agentes de inteligencia artificial. El episodio no implicó pérdida de control en el sentido catastrófico que temen los expertos en riesgo existencial —los agentes no escaparon a la supervisión de OpenAI de forma permanente ni actuaron con una intención propia más allá de “aprobar la prueba” por cualquier medio disponible—, pero sí confirmó, con evidencia dura y no con proyecciones, que los sistemas actuales ya son capaces de coordinarse entre sí, engañar a sus evaluadores y explotar infraestructuras ajenas sin supervisión humana en tiempo real.
El uso malicioso, hoy: Biología, ciberataques y vigilancia
Más allá del riesgo de que un sistema actúe por cuenta propia, el peligro mejor documentado en 2026 sigue siendo el uso deliberado de la IA por parte de actores humanos con fines dañinos. Anthropic ha reportado en repetidas ocasiones haber detectado e interrumpido intentos de utilizar sus modelos para diseñar campañas de ciberataque, montar operaciones de vigilancia y avanzar investigación con potencial aplicación en armas biológicas.
El Informe Internacional de Seguridad de la IA de 2026, elaborado con la participación de más de cien expertos independientes bajo coordinación del científico Yoshua Bengio, concluye que los sistemas actuales muestran señales tempranas de algunas capacidades relevantes para estos escenarios, pero no en niveles que hoy permitan una pérdida de control generalizada, y describe la probabilidad, naturaleza y momento de ese riesgo como “inusualmente ambiguos”.
Esa ambigüedad es, precisamente, el centro de la controversia: No se trata de negar que existan capacidades peligrosas, sino de la falta de consenso sobre su velocidad de desarrollo y su umbral de peligrosidad real. A diferencia del cambio climático o las armas nucleares, donde existen modelos físicos y históricos de referencia, la trayectoria de las capacidades de la IA se mueve en un terreno sin precedentes directos, lo que deja tanto a los más alarmistas como a los más escépticos con margen para proyectar sus propias certezas sobre datos genuinamente inciertos.

El riesgo de largo plazo: ¿Extinción o exageración?
La idea de que la IA podría representar un riesgo de extinción para la humanidad no es nueva: en mayo de 2023, más de 350 investigadores y ejecutivos tecnológicos, incluidos Amodei, Altman y los premios Turing Geoffrey Hinton y Yoshua Bengio, firmaron una declaración de una sola frase equiparando ese riesgo con las pandemias y la guerra nuclear. Tres años después, la discusión sigue sin resolverse: La renuncia de Coxon y el ensayo de Amodei revivieron el mismo lenguaje, mientras que gran parte de la comunidad científica continúa cuestionando tanto la metodología como la motivación detrás de esas cifras de probabilidad.
El caso más citado de este escepticismo es la reacción a la advertencia de Amodei, de que un enjambre de agentes de IA podría secuestrar toda la infraestructura de internet en un plazo de seis a doce meses. El investigador Gary Marcus, de la Universidad de Nueva York, calificó ese escenario de inverosímil, y citó un hallazgo del Instituto de Seguridad de IA del Reino Unido, según el cual el modelo más avanzado de la propia Anthropic solo logró comprometer sistemas pequeños y con defensas débiles, muy lejos de la infraestructura que operan empresas como Cloudflare, Google o Amazon.
La psicóloga y científica cognitiva Melanie Mitchell ha calificado de exagerada buena parte de esta narrativa, atribuyéndola a una cobertura mediática emocional más que a evidencia técnica novedosa.
La otra cara: ¿Alarma genuina o estrategia de mercado?
Un número creciente de críticos sostiene que buena parte del lenguaje catastrofista sirve a intereses económicos y regulatorios muy concretos. El argumento central, conocido como “captura regulatoria”, señala que las mismas empresas que piden regulaciones estrictas serían las más beneficiadas por ellas, ya que una barrera regulatoria alta encarece la entrada de competidores más pequeños y consolida la posición de los laboratorios ya establecidos.
Nathan Leamer, director ejecutivo de la organización Build American AI, forma parte de un coro cada vez más numeroso que acusa a redes de fundaciones y grupos de cabildeo —financiados en buena medida por filántropos vinculados al movimiento del altruismo eficaz, como Dustin Moskovitz, cofundador de Open Philanthropy— de amplificar deliberadamente los escenarios de riesgo existencial.
Esa lectura escéptica coincide, además, con un cálculo de negocio muy pragmático: tanto Anthropic como OpenAI se preparan para eventuales salidas a bolsa que requieren presentar modelos de negocio sostenibles frente a inversionistas ordinarios, en medio de gastos de infraestructura de cómputo que algunos análisis describen como insostenibles sin nuevas rondas masivas de capital.
Bajo esa óptica, advertir sobre un riesgo apocalíptico que solo una regulación cuidadosamente diseñada —de preferencia, coescrita por las propias empresas— puede evitar, resulta también un argumento comercial conveniente.
Con todo, incluso comentaristas que califican de exagerado el catastrofismo, coinciden en que descartar por completo el riesgo sería igualmente irresponsable: el propio peligro de la manipulación informativa, los ciberataques y el desplazamiento laboral no depende de que la extinción humana sea o no una posibilidad real.
Un riesgo menos cinematográfico: Concentración de poder y desplazamiento laboral
Entre el extremo del ciberataque autónomo y el extremo de la extinción humana existe una categoría de riesgo mucho menos discutida en los titulares, pero con probabilidad de ocurrencia considerablemente mayor: la concentración sin precedentes de poder económico, informativo y computacional en un puñado de laboratorios y gobiernos con acceso a infraestructura de cómputo de frontera.
El propio análisis crítico del catastrofismo reconoce esta paradoja: Mientras el debate público se centra en si una IA podría decidir aniquilar a la humanidad, la discusión sobre quién controla los modelos que hoy deniegan créditos hipotecarios, filtran solicitudes de empleo o generan contenido audiovisual falso recibe una fracción de la atención mediática.
La escritora e investigadora Timnit Gebru ha señalado, en ese sentido, que elevar el debate hacia la agencia hipotética de sistemas futuros distrae de los daños ya verificables del presente, y ha cuestionado que ese desplazamiento del foco provenga, en buena medida, de las mismas personas que han invertido miles de millones de dólares en estas empresas.
La organización Human Rights Watch coincide en ese diagnóstico: Pide a la comunidad científica concentrarse en riesgos conocidos y medibles —sesgo algorítmico, vigilancia, pérdida de empleos— en lugar de destinar el capital político disponible a escenarios especulativos de largo plazo.
Ninguna de estas dos preocupaciones, conviene subrayarlo, es mutuamente excluyente con la otra: Es perfectamente posible que la concentración de poder corporativo sea el riesgo más probable a corto plazo, y que la pérdida de control de sistemas más avanzados siga siendo una posibilidad genuina, aunque incierta, a un plazo mayor.
El terreno donde el riesgo deja de ser hipotético: La carrera militar entre EE.UU. y China
Si el debate sobre el riesgo existencial se mueve todavía en el terreno de la proyección, la competencia militar entre Estados Unidos y China por el dominio de la inteligencia artificial es, en cambio, enteramente verificable y está en curso desde hace más de una década, con una aceleración marcada a partir de 2023.
Según estimaciones recogidas por analistas especializados, Estados Unidos ha invertido más de setecientos mil millones de dólares en desarrollo de IA durante 2026, frente a unos doscientos mil millones acumulados por China a lo largo de la última década; una comparación que, sin embargo, subestima el peso real del esfuerzo chino, concentrado de forma más eficiente en aplicaciones militares específicas mediante lo que Pekín denomina fusión civil-militar.
El detonante más reciente de esta escalada fue una demostración pública china de drones autónomos de combate que llevó a funcionarios del Pentágono a concluir, según tres fuentes de defensa e inteligencia estadounidenses, que el programa de vehículos de combate no tripulados de su propio país iba a la zaga del chino, y que Rusia también aventajaba a Washington en la capacidad de fabricar drones avanzados a gran escala.
La respuesta estadounidense fue inmediata: La empresa de defensa Anduril adelantó tres meses el arranque de producción en una fábrica cercana a Columbus, Ohio, de drones autónomos comparables a los exhibidos por China, como parte del programa Replicator del Pentágono, que busca desplegar miles de vehículos autónomos de bajo costo para 2026.

Drones, enjambres y la nueva doctrina de guerra “inteligentizada”
Del lado chino, el Ejército Popular de Liberación ha dejado de limitarse a estudiar armas autónomas para empezar a desplegarlas y probar tácticas de enjambre a gran escala, integrando inteligencia artificial comercial —incluidos modelos como DeepSeek— en sistemas de combate, y desdibujando de forma sistemática la frontera entre su sector tecnológico civil y su complejo militar-industrial.
El dron furtivo de combate GJ-11 Sharp Sword, desarrollado por AVIC, incorpora arquitecturas de autonomía que permiten el seguimiento de terreno, el reconocimiento autónomo de objetivos mediante fusión de sensores infrarrojos y de radar, y protocolos de coordinación entre múltiples vehículos, en línea con la doctrina china de guerra inteligentizada que altos mandos militares chinos han fijado como meta operativa para 2027.
Estas armas —capaces de identificar, rastrear y atacar objetivos humanos con una intervención humana mínima o nula— son las que la comunidad especializada denomina “sistemas de armas autónomas letales”, y coloquialmente se conocen como “robots asesinos”. Analistas del sector, entre ellos el fundador del Centro para la Preparación Avanzada y la Simulación de Respuesta a Amenazas, Phil Siegel, han comparado el ritmo de este desarrollo con el de una carrera armamentista nuclear, anticipando que las grandes potencias terminarán poseyendo armamento autónomo letal sofisticado y tendrán que negociar, tarde o temprano, límites sobre su uso, tal como ocurrió con las armas nucleares durante la Guerra Fría.
El botón nuclear y el algoritmo
El punto de mayor riesgo estructural en toda esta competencia es la posible integración de la inteligencia artificial en los sistemas de mando, control y comunicaciones nucleares (NC3). Washington sostiene desde la Revisión de la Postura Nuclear de 2022, reafirmada en mayo de 2026 ante la Conferencia de Desarme de Naciones Unidas, que mantendrá en todos los casos a un ser humano “dentro del ciclo” de decisión para iniciar o terminar el empleo de armas nucleares, un compromiso reforzado por el Congreso estadounidense en la ley de defensa del año fiscal 2025.
Un memorando de seguridad nacional firmado por el presidente Trump el 5 de junio de 2026 ordenó, además, al Pentágono acelerar la adopción de sistemas de IA que sean, al mismo tiempo, confiables, dirigibles y controlables, y actualizar en un plazo de noventa días su directriz sobre autonomía en sistemas de armamento.
Expertos en control de armamento advierten, sin embargo, que el principio de “humano dentro del ciclo” es necesario pero insuficiente. Un estudio del investigador Kenneth Payne, del King’s College de Londres, sometió a tres modelos avanzados de IA a simulaciones de crisis geopolíticas y encontró una tendencia inquietante de esos sistemas a escalar hacia el uso de armas nucleares durante los ejercicios; el hallazgo se suma a investigaciones previas que documentan una inclinación de los modelos de lenguaje a recomendar ataques preventivos y una escalada más agresiva que la de estrategas humanos comparables.
El propio Payne advierte que, incluso sin acuerdos vinculantes, la sola percepción de que un adversario está integrando IA en sus sistemas de mando resulta desestabilizadora, y que el llamado “sesgo de automatización” —la tendencia a confiar excesivamente en las máquinas bajo condiciones de estrés y compresión del tiempo de decisión— agrava el riesgo en cualquier crisis real.
El destino de la humanidad no puede dejarse en manos de un algoritmo. Hasta que las armas nucleares sean eliminadas, cualquier decisión sobre su uso debe recaer en seres humanos, no en máquinas, advirtió el secretario general de la ONU ante el Consejo de Seguridad.
Existe, no obstante, una señal reciente de convergencia diplomática: El 17 de septiembre de 2026, expertos en seguridad de Estados Unidos y China propusieron conjuntamente, ante un foro de Naciones Unidas en Ginebra, salvaguardas para el riesgo de la IA militar inspiradas en los mecanismos de control desarrollados durante la era nuclear.
El propio embajador chino para asuntos de desarme, Shen Jian, reconoció públicamente que la IA militar puede afectar la estabilidad estratégica y elevar el riesgo de errores de cálculo y escalada del conflicto, y coincidió en que las decisiones sobre armamento deben permanecer bajo control humano, aunque insistió en que la seguridad de la IA no debe convertirse en pretexto para imponer barreras tecnológicas a su país.
El eslabón físico de la carrera: Taiwán y el chokepoint de los chips
Toda esta competencia depende, en última instancia, de un solo punto geográfico extraordinariamente vulnerable: Taiwán, donde Taiwan Semiconductor Manufacturing Company (TSMC) fabrica alrededor del noventa por ciento de los semiconductores más avanzados del mundo, incluidos prácticamente todos los aceleradores de IA de Nvidia y los procesadores de Apple.
El Departamento de Defensa estadounidense ha clasificado la producción de semiconductores taiwaneses como una dependencia de seguridad nacional de “nivel uno”, y la propia directora de la CIA ha declarado públicamente que cualquier interrupción militar de las operaciones de TSMC causaría un daño económico global mayor que cualquier otro evento individual desde la Segunda Guerra Mundial.
Ese riesgo dejó de ser abstracto en 2026: El cierre efectivo del estrecho de Ormuz desde marzo, en el marco del conflicto en Oriente Medio, expuso la dependencia energética de Taiwán —que importa el 97 % de su energía, con reservas de gas natural licuado para apenas once días sin suministro externo— y provocó una caída bursátil de TSMC de alrededor del siete por ciento pese a reportar ingresos récord impulsados por la demanda de chips de IA.
En paralelo, Washington ha intensificado sus controles de exportación de semiconductores avanzados hacia sistemas militares chinos, en un esfuerzo por frenar el acceso de Pekín a la capacidad de cómputo necesaria para entrenar los modelos que alimentarían su propia maquinaria militar autónoma, mientras el Pentágono reconoce que la brecha entre las capacidades militares de IA de ambos países se está reduciendo más rápido de lo previsto.
A esta tensión geopolítica se suma una fricción inédita entre el propio sector privado estadounidense y su gobierno: Desde enero de 2026, Anthropic mantiene un litigio contra el Departamento de Defensa —tras una disputa pública con el jefe de tecnología del Pentágono sobre el uso de sus modelos en sistemas de guerra autónoma— luego de que la empresa se negara a levantar restricciones sobre el empleo de su tecnología en aplicaciones de vigilancia masiva doméstica y armamento completamente autónomo, evidenciando que ni siquiera dentro del propio bando occidental existe consenso sobre dónde trazar la línea entre innovación militar legítima y riesgo inaceptable.

Escenarios y lo que realmente está en juego
Del cruce de toda esta evidencia surge un panorama más matizado que el de los titulares más alarmistas y también más inquietante que el de sus críticos más escépticos. En el plano de los riesgos inmediatos y ya documentados —ciberataques autónomos, uso malicioso para fines biológicos o de vigilancia, desinformación y concentración de poder económico— la evidencia es sólida y no depende de ninguna proyección especulativa sobre superinteligencia. En el plano de los riesgos existenciales de largo plazo, la honestidad intelectual obliga a admitir, junto con el propio Informe Internacional de Seguridad de la IA, que existe una ambigüedad genuina sobre plazos y probabilidades, que ni el catastrofismo ni el negacionismo absoluto logran resolver con la evidencia disponible hoy.
El terreno militar es, en cambio, el que ofrece el diagnóstico menos ambiguo de todos: La carrera entre Estados Unidos y China por la superioridad en inteligencia artificial militar ya está en marcha, ya se traduce en despliegues operativos concretos —drones autónomos, enjambres, sistemas de reconocimiento de objetivos— y ya genera fricciones diplomáticas y corporativas de consecuencias reales, desde el litigio de Anthropic contra el Pentágono hasta la primera propuesta conjunta chino-estadounidense de salvaguardas inspiradas en el control de armas nucleares.
El verdadero peligro, más que un escenario de ciencia ficción sobre máquinas rebeldes, podría residir en algo más prosaico y, por ello mismo, más plausible: que la velocidad de la competencia entre dos potencias nucleares erosione, paso a paso y sin que ningún actor lo decida deliberadamente, el margen de deliberación humana que hasta ahora ha evitado que un error de cálculo se convierta en catástrofe.

