04 Auswege
Die Auswege, die tatsächlich existieren
Technische und institutionelle Kontrollen bestimmen, ob die schweren Szenarien aus Kapitel 02 wahrscheinlicher oder unwahrscheinlicher werden; Vorsorge im Haushalt kann sie nicht ersetzen.
Technische Sicherheitshebel
- Interpretierbarkeitsforschung. Das Untersuchen interner Modellrepräsentationen und Berechnungen als Ergänzung zu Verhaltensbewertungen, Zugriffskontrollen und Überwachung im Einsatz.
- Skalierbare Aufsicht. Techniken — Debatte, rekursive Belohnungsmodellierung, Verallgemeinerung von schwach zu stark — die weniger fähigen Aufsehern helfen sollen, fähigere Systeme zu überwachen.
- Korrigierbarkeitsforschung. Untersucht, wie Systeme empfänglich für legitime Korrektur, Änderung und Abschaltung bleiben könnten; eine skalenrobuste Lösung wurde bisher nicht nachgewiesen.
- Compute-Governance. Jurisdiktionsspezifische Exportkontrollen, Infrastrukturüberwachung und Schwellenwerte, die als unvollkommene Näherungswerte für Fähigkeit verwendet werden — nicht als Definition von AGI oder Sicherheit.
Der Vorstandsvorsitzende von Anthropic hat den Fall für den ersten dieser Punkte in seinem Essay von 2025 zu diesem Thema dargelegt:
Dario Amodei argues that researchers still lack a precise account of why models choose particular outputs.
The Urgency of Interpretability, Primary source
Institutionelle Hebel
Internationale Koordination ist wichtig, weil einseitige Kontrollen sowohl Sicherheitsanreize als auch Wettbewerbsposition verändern können. Die politische Landschaft ist nicht mehr vollständig freiwillig: Der EU AI Act legt Anbietern im Geltungsbereich verbindliche Pflichten auf, während die Sicherheitsrahmenwerke der Labore und Gipfelzusagen weitgehend freiwillig bleiben. Derzeit existiert kein verbindlicher globaler Rüstungskontrollvertrag für Frontier-Modelle.
Ein früher internationaler Ausgangspunkt war die nicht bindende Erklärung, die von 28 Ländern und der EU auf dem ersten globalen KI-Sicherheitsgipfel unterzeichnet wurde:
28 nations and the European Union commits signatories to AI that is designed, developed, deployed and used safely and responsibly.
GOV.UK, Signed statement
- Risikoproportionale Bewertung vor dem Einsatz für gefährliche Fähigkeiten, bevor eine uneingeschränkte Veröffentlichung erfolgt.
- Vorfallmeldungen, die es Regulierungsbehörden und Entwicklern ermöglichen, aus schweren Fehlschlägen und knapp vermiedenen Zwischenfällen zu lernen.
- Haftungsregeln, die Kontrolle, Wissen, Kausalität und die Fähigkeit zur Schadensverhütung berücksichtigen.
Was ein einzelner Technologe tun kann
Leser können Politik als Wähler, Arbeitnehmer, Forscher, Kunden, Investoren und Mitglieder zivilgesellschaftlicher Organisationen beeinflussen. Praktische Optionen umfassen: Beiträge zu oder Finanzierung von Interpretierbarkeits- und Alignment-Forschung; Sicherheitspraktiken innerhalb der eigenen Organisation vorantreiben, wenn du KI-Systeme im Produktivbetrieb einsetzt; die oben genannte Melde- und Bewertungsinfrastruktur unterstützen, statt sie als regulatorische Reibung zu behandeln; und Quelle und Beleg hinter überzeugenden Behauptungen prüfen, statt entweder automatisierte Manipulation oder echten Konsens anzunehmen.