04 Vías de escape
Las vías de escape que realmente existen
Los controles técnicos e institucionales determinan si los escenarios graves del capítulo 02 se vuelven más o menos probables; la preparación doméstica no puede sustituirlos.
Palancas técnicas de seguridad
- Investigación en interpretabilidad. Inspeccionar las representaciones internas y el cómputo de los modelos como un complemento a las evaluaciones de comportamiento, los controles de acceso y la monitorización del despliegue.
- Supervisión escalable. Técnicas —debate, modelado recursivo de recompensas, generalización de débil a fuerte— pensadas para ayudar a supervisores menos capaces a vigilar sistemas más capaces.
- Investigación en corregibilidad. Estudiar cómo los sistemas podrían seguir siendo receptivos a la corrección, la modificación y el apagado legítimos; no se ha demostrado ninguna solución robusta a escala.
- Gobernanza del cómputo. Controles de exportación específicos de cada jurisdicción, monitorización de infraestructura y umbrales usados como aproximaciones imperfectas de la capacidad, no como una definición de AGI o de seguridad.
El director ejecutivo de Anthropic defendió el primero de estos puntos en su ensayo de 2025 sobre el tema:
Dario Amodei argues that researchers still lack a precise account of why models choose particular outputs.
The Urgency of Interpretability, Primary source
Palancas institucionales
La coordinación internacional importa porque los controles unilaterales pueden cambiar tanto los incentivos de seguridad como la posición competitiva. El panorama regulatorio ya no es del todo voluntario: la Ley de IA de la UE impone obligaciones vinculantes a los proveedores dentro de su alcance, mientras que los marcos de seguridad de los laboratorios y los compromisos de las cumbres siguen siendo en gran medida voluntarios. Actualmente no existe ningún tratado vinculante de control de armamento de modelos de frontera a escala global.
Un primer punto de partida internacional fue la declaración no vinculante respaldada por 28 países y la UE en la primera cumbre mundial de seguridad de la IA:
28 nations and the European Union commits signatories to AI that is designed, developed, deployed and used safely and responsibly.
GOV.UK, Signed statement
- Evaluación previa al despliegue, proporcional al riesgo, de capacidades peligrosas antes de una publicación sin restricciones.
- Notificación de incidentes que permita a reguladores y desarrolladores aprender de fallos graves y de los casos que estuvieron cerca de serlo.
- Normas de responsabilidad que tengan en cuenta el control, el conocimiento, la causalidad y la capacidad de prevenir el daño.
Qué puede hacer un tecnólogo a nivel individual
Los lectores pueden influir en la política como votantes, trabajadores, investigadores, clientes, inversores y miembros de organizaciones cívicas. Las opciones prácticas incluyen contribuir a la investigación en interpretabilidad y alineación o financiarla; impulsar prácticas de seguridad dentro de tu propia organización si despliegas sistemas de IA en producción; apoyar la infraestructura de notificación y evaluación descrita arriba en lugar de tratarla como una carga regulatoria; y verificar la fuente y la evidencia detrás de afirmaciones persuasivas en lugar de asumir manipulación automatizada o consenso genuino.