07 Механизмы
Механизмы, стоящие за худшими сценариями
Глава 02 рассматривает общий механизм потери контроля. Эта глава — реестр конкретных, поимённо описанных путей, которые реально изучают исследователи, — потому что мера, предотвращающая один из них, не обязательно предотвращает другой.
Почему это не один сценарий
Фраза «ИИ может убить всех» сжимает несколько структурно различных сценариев отказа в один образ. Такое сжатие полезно для заголовка и бесполезно для предотвращения, потому что технические и политические меры, устраняющие один механизм, могут почти не помочь против другого — например, контроль над крупным прогоном обучения сам по себе не предотвращает злоупотребление уже развёрнутой моделью. Более 350 исследователей и руководителей, включая людей, связанных с несколькими крупными лабораториями, подписали в 2023 году заявление из одного предложения, призывающее политиков рассматривать риск вымирания как глобальный приоритет. Оно фиксирует позицию, которой придерживаются видные подписанты; оно не измеряет вероятность вреда:
Signatories to the Statement on AI Risk hold that mitigating the risk of extinction from AI should be a global priority alongside pandemics and nuclear war.
safe.ai, Signed statement
Три широкие категории
Международный доклад о безопасности ИИ за 2026 год использует три широкие категории. Злонамеренное использование — это когда человек сознательно направляет возможности ИИ на причинение массового вреда: инженерные пандемии, атаки на инфраструктуру или автономное оружие. Сбои в работе включают отказы надёжности и предполагаемые сценарии потери контроля, при которых системы действуют вне чьего-либо контроля. Системные риски возникают через широкое развёртывание и институциональное взаимодействие, включая концентрацию, разрушение рынка труда и постепенное лишение человечества влияния. Категории могут пересекаться, а сила доказательств различается в зависимости от механизма. Председатель доклада публично подчёркивал важность потери контроля:
Yoshua Bengio warned that future systems exhibiting self-preservation behavior could create a loss-of-control risk.
AFP, via TechXplore, Secondary coverage
Джеффри Хинтон также предложил личную оценку вероятности. Это экспертное суждение в условиях неопределённости, а не измеренная частота:
Geoffrey Hinton said in a December 2024 BBC interview that he put the chance of AI causing human extinction within thirty years at 10–20%.
BBC Radio 4, reported by The Guardian, Secondary coverage
Чего эта глава не делает
Каждая страница отличает документированные доказательства от прогнозов и теории, одновременно называя меры смягчения, предлагаемые исследователями. Ни одна из них не описывает детали синтеза, эксплойтов или атак — такая информация не сделала бы читателя безопаснее, а её публикация не является тем, чего требует осознанная подготовка. См. стандарт источников, чтобы узнать, как классифицируются и проверяются существенные утверждения.