07 Mecanismos
Los mecanismos detrás de los peores desenlaces
El capítulo 02 cubre el mecanismo general de pérdida de control. Este capítulo es el registro de vías específicas y nombradas que los investigadores realmente estudian — porque la intervención que evita una no necesariamente evita otra.
Por qué esto no es un solo escenario
«La IA podría matarnos a todos» comprime varios modos de fallo estructuralmente distintos en una sola imagen. Esa compresión es útil para un titular e inútil para la prevención, porque las intervenciones técnicas y de política que abordan un mecanismo pueden hacer poco por otro — los controles sobre una gran ejecución de entrenamiento, por ejemplo, no evitan por sí solos el uso indebido de un modelo ya desplegado. Más de 350 investigadores y ejecutivos, incluidas personas afiliadas a varios laboratorios importantes, firmaron en 2023 una declaración de una sola frase instando a los responsables de política a tratar el riesgo de extinción como una prioridad global. Registra una postura sostenida por firmantes destacados; no mide la probabilidad de un daño:
Signatories to the Statement on AI Risk hold that mitigating the risk of extinction from AI should be a global priority alongside pandemics and nuclear war.
safe.ai, Signed statement
Tres grandes familias
El Informe Internacional de Seguridad de la IA de 2026 usa tres grandes familias. El uso malicioso es un humano que dirige deliberadamente la capacidad de la IA hacia un daño masivo — pandemias diseñadas, ataques a infraestructura, o armas autónomas. Los fallos de funcionamiento incluyen fallas de fiabilidad y escenarios prospectivos de pérdida de control en los que los sistemas operan fuera del control de cualquiera. Los riesgos sistémicos surgen mediante el despliegue generalizado y la interacción institucional, incluidas la concentración, la disrupción laboral y el desempoderamiento humano gradual. Las categorías pueden solaparse, y la solidez de la evidencia difiere entre mecanismos. El presidente del informe ha enfatizado públicamente la pérdida de control:
Yoshua Bengio warned that future systems exhibiting self-preservation behavior could create a loss-of-control risk.
AFP, via TechXplore, Secondary coverage
Geoffrey Hinton también ha ofrecido una estimación de probabilidad personal. Es un juicio experto bajo incertidumbre, no una frecuencia medida:
Geoffrey Hinton said in a December 2024 BBC interview that he put the chance of AI causing human extinction within thirty years at 10–20%.
BBC Radio 4, reported by The Guardian, Secondary coverage
Lo que este capítulo no hace
Cada página distingue la evidencia documentada de los pronósticos y la teoría, a la vez que nombra las mitigaciones que proponen los investigadores. Ninguna describe detalles de síntesis, exploits o ataques — esa información no haría más seguro a un lector, y publicarla no es lo que exige una preparación informada. Consulta el estándar de fuentes para saber cómo se clasifican y revisan las afirmaciones consecuentes.