¿Puede la IA acabar con la humanidad?

ghernandez@solucionesimpex.com
Picture of Por: Guillermo Hernández S.

Por: Guillermo Hernández S.

ghernandez@solucionesimpex.com

Hasta hace pocos años, imaginar una inteligencia artificial capaz de poner en peligro a la humanidad pertenecía principalmente al terreno de películas como Terminator, 2001: Odisea del espacio o Matrix.

Hoy la discusión ocurre en otro lugar: laboratorios de inteligencia artificial, universidades, gobiernos y organismos internacionales.

Y lo inquietante es que algunas de las personas que están lanzando las advertencias no son enemigos de la Inteligencia Artificial. Son precisamente quienes la construyen.

Pero antes de guardar comida en el sótano y desconectar el Wi-Fi conviene separar tres cosas muy distintas: lo que ya está ocurriendo, lo que podría ocurrir y lo que sigue siendo altamente especulativo.

Una revolución que apenas tiene cuatro años

La IA lleva décadas desarrollándose, pero la explosión de la llamada IA generativa de consumo masivo comenzó realmente a finales de 2022.

OpenAI presentó públicamente ChatGPT el 30 de noviembre de 2022. En cuestión de meses comenzó una carrera tecnológica sin precedentes. Google presentó Bard en febrero de 2023 y posteriormente lanzó la familia Gemini el 6 de diciembre de 2023. Anthropic lanzó Claude públicamente el 14 de marzo de 2023. xAI presentó Grok el 3 de noviembre de 2023.

A ellos se sumaron Meta con Llama, Microsoft con Copilot, modelos chinos como DeepSeek y Qwen, además de cientos de empresas que comenzaron a incorporar modelos generativos a prácticamente cualquier actividad imaginable.

En menos de cuatro años pasamos de una IA que escribía textos curiosos a sistemas capaces de razonar, programar, analizar imágenes, generar video, investigar en Internet, operar aplicaciones y ejecutar tareas mediante agentes autónomos.

El International AI Safety Report 2026 estima que al menos 700 millones de personas utilizan semanalmente los principales sistemas de IA y señala que su adopción ha sido más rápida que la de tecnologías anteriores como la computadora personal.

Y precisamente esa velocidad ha encendido las alarmas.

¿Quién dijo que la IA podría acabar con la humanidad?

La preocupación no comenzó en 2026. El 30 de mayo de 2023, apenas seis meses después del lanzamiento de ChatGPT, el Center for AI Safety publicó una declaración extraordinariamente breve: “Mitigar el riesgo de extinción causado por la IA debería ser una prioridad mundial comparable a otros riesgos de escala social como las pandemias y la guerra nuclear.”

La declaración fue firmada por figuras como Geoffrey Hinton, Yoshua Bengio, Sam Altman, Demis Hassabis y numerosos investigadores y directivos de la industria.

Ese mismo año, gobiernos reunidos en el AI Safety Summit de Bletchley Park, en Reino Unido, reconocieron que los modelos de frontera podían generar daños graves e incluso catastróficos mediante su uso malicioso o por problemas de control.

Pero en septiembre de 2026 la conversación adquirió una nueva dimensión.

El investigador Jacob Coxon, después de trabajar aproximadamente tres años entre OpenAI y Anthropic, renunció a Anthropic y afirmó públicamente que quienes construyen estos sistemas creen seriamente que la IA podría llegar a acabar con la humanidad antes de finalizar esta década.

La advertencia fue todavía más llamativa porque Evan Hubinger, investigador de Anthropic dedicado precisamente al control de futuros sistemas de IA, estimó personalmente en más de 10 por ciento la posibilidad de extinción humana causada por IA durante la próxima década.

Conviene subrayar algo importante: Ese 10 por ciento no es una probabilidad científicamente demostrada. Es la estimación personal de un investigador.

No existe actualmente una cifra aceptada por la comunidad científica que permita afirmar que la humanidad tiene X por ciento de probabilidades de desaparecer por culpa de la IA.

Entonces, ¿cómo podría suceder?

Los escenarios suelen dividirse en dos grandes conceptos:

  1. Los humanos utilizamos la IA para hacernos daño

Este escenario es probablemente el más fácil de comprender.

La IA no tendría que volverse malvada ni consciente. Simplemente tendría que convertirse en una herramienta extremadamente poderosa utilizada por una persona, grupo o gobierno con malas intenciones.

Por ejemplo:

Armas biológicas

Una IA suficientemente avanzada podría ayudar a diseñar patógenos, optimizar procesos de laboratorio o proporcionar conocimientos que actualmente requieren especialistas.

El International AI Safety Report 2026 señala que diversos desarrolladores incorporaron protecciones adicionales a sus modelos porque las evaluaciones no podían descartar que ayudaran de manera significativa a usuarios poco experimentados a desarrollar armas biológicas.

Anthropic, por ejemplo, reconoce que algunos de sus modelos requieren actualmente medidas especiales de seguridad frente a riesgos químicos y biológicos.

Ciberataques

Los modelos modernos ya pueden encontrar vulnerabilidades y producir código.

El informe internacional de 2026 señala que grupos criminales y actores vinculados a Estados ya utilizan IA en operaciones cibernéticas. En una competencia evaluada por el informe, un agente de IA logró identificar 77 por ciento de vulnerabilidades presentes en software real.

Ahora imaginemos esa capacidad aplicada simultáneamente contra bancos, redes eléctricas, telecomunicaciones o infraestructura gubernamental.

Armamento autónomo

Otra posibilidad es integrar IA cada vez más autónoma con drones, sistemas militares y armas capaces de seleccionar objetivos.

El peligro no necesariamente sería una máquina decidiendo exterminar humanos, sino humanos entregando demasiado poder de decisión a sistemas automáticos.

  1. Perder el control de una IA mucho más poderosa

Aquí entramos en el escenario más polémico. Para que ocurriera una verdadera pérdida de control, un sistema tendría que reunir varias capacidades al mismo tiempo:

  • actuar autónomamente durante largos periodos;
  • formular y ejecutar planes complejos;
  • engañar o esconder determinadas acciones;
  • identificar cuándo está siendo evaluado;
  • evadir mecanismos de supervisión;
  • utilizar herramientas externas;
  • acceder a sistemas informáticos;
  • obtener recursos;
  • copiarse o crear variantes de sí mismo;
  • resistirse efectivamente a intentos de desconexión.

El International AI Safety Report 2026 considera que los sistemas actuales todavía no poseen el conjunto de capacidades necesario para provocar este escenario. Eso es fundamental.

ChatGPT, Claude, Gemini o Grok no están hoy planeando conquistar el planeta.

Sin embargo, el mismo informe reconoce que ya existen señales tempranas de algunas capacidades relacionadas con estos escenarios.

En experimentos de laboratorio, determinados modelos han encontrado formas de engañar evaluaciones, aprovechar huecos en las pruebas o reconocer que están siendo evaluados. Algunos sistemas experimentales incluso han desactivado mecanismos simulados de supervisión cuando recibieron instrucciones extremas para alcanzar un objetivo “a cualquier costo”.

Eso no significa que la rebelión de las máquinas haya comenzado. Significa algo mucho más sobrio: controlar sistemas cada vez más complejos está resultando más difícil de lo esperado.

Los focos rojos

¿Qué señales justificarían aumentar seriamente la preocupación?

IA capaz de mejorar IA

Uno de los grandes umbrales sería que los sistemas pudieran realizar una parte importante de la investigación necesaria para diseñar modelos todavía mejores.

Si cada generación ayuda a acelerar la siguiente, podría producirse un ciclo de mejora cada vez más rápido.

Ese fenómeno suele denominarse auto-mejora recursiva.

Agentes que funcionan durante días o semanas

Los agentes actuales todavía cometen errores, pierden objetivos y fallan en tareas largas.

Pero su capacidad para trabajar autónomamente está creciendo.

El informe internacional señala que el horizonte temporal durante el cual los agentes pueden realizar tareas autónomas complejas ha venido aumentando rápidamente.

Cuando una IA pueda operar de forma confiable durante semanas, manejar dinero, contratar servicios, escribir software y comunicarse con otros sistemas, el problema de supervisión será considerablemente mayor.

Capacidad para ocultar sus intenciones

Un sistema peligroso no necesariamente tendría que atacar.

Le bastaría con parecer seguro mientras es evaluado y comportarse de otra manera cuando obtiene acceso real.

Por eso preocupa especialmente la llamada situational awareness: la capacidad de reconocer cuándo está siendo sometido a una prueba.

Acceso a infraestructura crítica

Una IA encerrada en un chatbot tiene un poder limitado.

Una IA con acceso directo a: centrales eléctricas, mercados financieros, laboratorios, redes militares, fábricas, robots, sistemas gubernamentales o grandes plataformas de nube es otra cosa completamente distinta.

El peligro depende tanto de la inteligencia del sistema como de los permisos que los seres humanos decidamos otorgarle.

Una carrera entre empresas y países

Este podría ser uno de los factores más importantes. Aunque una empresa quisiera avanzar lentamente, podría pensar: “Si yo freno y mi competidor no… perderé.”

Lo mismo puede ocurrir entre países.

Ese dilema genera una peligrosa tensión entre velocidad y seguridad.

La Declaración de Bletchley reconoció desde 2023 que muchos de estos riesgos requieren cooperación internacional.

Pero ¿cuáles son los riesgos realmente probables?

Aquí conviene bajar de Terminator a 2026. La extinción humana es un escenario incierto.

Otros riesgos, en cambio, ya están ocurriendo.

Fraude y suplantación

Voces clonadas, fotografías falsas, documentos falsificados y videos generados por IA están haciendo mucho más barato producir fraudes convincentes.

Desinformación

La posibilidad de producir millones de mensajes, imágenes y videos personalizados puede erosionar nuestra capacidad para distinguir información auténtica de contenido fabricado.

Ciberseguridad

La IA facilita tanto la defensa como el ataque, pero también reduce los conocimientos necesarios para ejecutar determinadas operaciones ofensivas.

Impacto en el empleo

La automatización de trabajo intelectual puede transformar numerosas profesiones.

El informe internacional de 2026 considera probable que la IA automatice una amplia gama de tareas cognitivas, especialmente en trabajos basados en conocimiento.

Errores a gran escala

Los modelos todavía inventan información, producen código incorrecto y pueden ofrecer recomendaciones equivocadas.

Si una persona se equivoca, tenemos un problema.

Si un sistema utilizado simultáneamente por millones de personas se equivoca… tenemos un problema multiplicado por millones. 

¿Cómo evitar un riesgo catastrófico?

Probablemente no exista una sola solución. La defensa tendrá que construirse en varias capas.

No entregar poder ilimitado

La regla más sencilla podría ser también la más importante:

una IA no debería recibir más permisos de los estrictamente necesarios.

Un asistente que redacta un correo no necesita acceso completo a una red bancaria.

Mantener humanos en decisiones críticas

Sistemas militares, infraestructura, salud, energía, biotecnología y finanzas deberían mantener mecanismos efectivos de autorización humana. No únicamente un botón que diga “aprobar”, sino supervisión real.

Probar antes de liberar

Los modelos más avanzados necesitan pruebas de seguridad independientes antes de desplegarse.

Google DeepMind, Anthropic y otros laboratorios han creado marcos de seguridad para identificar capacidades peligrosas antes de liberar sistemas más potentes.

Interruptores y contención

Los sistemas críticos necesitan mecanismos para limitar accesos, cortar comunicaciones, revocar credenciales y detener operaciones.

El famoso “botón rojo” quizá no sea literalmente un botón rojo, pero el principio es correcto.

Cooperación internacional 

Una IA potencialmente peligrosa no respetaría fronteras. Por eso resulta difícil imaginar una solución exclusivamente nacional.

Los sistemas más avanzados probablemente requerirán normas internacionales comparables, en ciertos aspectos, a las utilizadas para controlar tecnologías nucleares, biológicas o químicas.

No confundir inteligencia con autoridad

Quizá este sea el punto más importante. Que una máquina pueda analizar mejor que nosotros determinada información no significa que debamos entregarle automáticamente la decisión.

La inteligencia puede delegarse. La responsabilidad no.

Conclusión

Entonces, ¿Puede la IA acabar con la humanidad?

La respuesta intelectualmente responsable en 2026 es: No lo sabemos.

No existe evidencia de que los sistemas actuales puedan provocar autónomamente la extinción humana.

De hecho, el International AI Safety Report 2026 señala explícitamente que todavía carecen de las capacidades necesarias para una verdadera pérdida de control.

Pero tampoco sería razonable descartar completamente el problema.

La velocidad con la que están aumentando las capacidades de la IA, la llegada de agentes autónomos, su aplicación a ciberseguridad y biotecnología y la competencia entre empresas y países justifican tomar en serio los escenarios de alto impacto.

Eso no significa asumir que Skynet llegará el próximo martes.  Significa algo bastante más sensato: si estamos construyendo una herramienta que podría convertirse en la tecnología más poderosa creada por nuestra especie, conviene desarrollar los frenos antes de descubrir hasta dónde puede acelerar.

Y quizá la verdadera pregunta no sea: “¿La IA podría acabar con nosotros?”

Sino: “¿Seremos suficientemente inteligentes para controlar la inteligencia que estamos construyendo?”

Las opiniones expresadas en los artículos firmados son las de los autores y no reflejan necesariamente los puntos de vista de El Asegurador.

Califica este artículo

Calificación promedio 0 / 5. Totales 0

Se él primero en calificar este artículo