Situation report active Rev. 2026.9 119 reports 239 source records updated
Real Life After AGI Брифинг о выживании человечества
RU

Защита осведомителей внутри лабораторий ИИ

Как права осведомителей, каналы отчётности и правила против ответных мер помогают сотрудникам лабораторий ИИ раскрывать сбои безопасности до вреда обществу.

Written by
Dwight Ringdahl
Status
Источники проверены
Revised
Sources
4 cited
Reading
6 min

Инсайдеры видят доказательства раньше общества

Сотрудники и подрядчики могут сталкиваться с опасными результатами оценок, сбоями безопасности, вводящими в заблуждение публичными заявлениями, незаконными практиками обращения с данными или давлением развернуть систему до того, как опасения будут сняты. Регуляторы и клиенты часто видят только тщательно отобранные отчёты. Защищённая внутренняя и внешняя отчётность способна сократить время между обнаружением проблемы и её исправлением.

Это не гипотетическая проблема. В 2024 году нынешние и бывшие сотрудники OpenAI и Google DeepMind публично призвали компании, занимающиеся ИИ, не применять ответные меры к персоналу, поднимающему вопросы безопасности после того, как внутренние каналы не сработали, — требование, поддержанное тремя из самых цитируемых исследователей безопасности в этой области: Йошуа Бенджио, Джеффри Хинтоном и Стюартом Расселом (нынешние и бывшие сотрудники OpenAI и Google DeepMind, 2024). Уже сам факт, что это требование пришлось выдвигать публично, поимённо, — свидетельство того, что существующие внутренние каналы не воспринимались как достаточные.

Практика осведомительства не заменяет аудиты или компетентное управление. Сотрудники могут ошибаться, не располагать полным контекстом или действовать из смешанных побуждений. Хорошая система защищает добросовестную отчётность и независимо расследует доказательства, а не заранее исходит из того, что права компания или заявитель.

Правовая база фрагментирована

Единого федерального «закона США о защите осведомителей в сфере ИИ», охватывающего любые опасения по безопасности, не существует. Существующие меры защиты зависят от работодателя, отрасли, договора, юрисдикции и того, о чём именно сообщается. Законы могут защищать раскрытие информации о мошенничестве с ценными бумагами, государственных контрактах, дискриминации, охране труда или конкретных нарушениях, тогда как опасение по поводу катастрофической возможности модели может не вписываться в эти категории однозначно.

Соглашения о неразглашении не могут на законных основаниях отменить любое защищённое законом право, но сотрудники могут не знать, где проходит эта граница, и столкнуться с дорогостоящими спорами. Правила о коммерческой тайне, приватности и национальной безопасности могут ограничивать публичное раскрытие информации даже там, где должен существовать защищённый канал связи с регулятором. Эта страница — общая информация, а не юридическая консультация.

Калифорния создала специальную защиту для сферы ИИ

Калифорнийский Закон о прозрачности передового искусственного интеллекта, SB 53, вступил в силу в 2026 году. В рамках установленных им определений охваченные законом сотрудники могут сообщать о нарушениях или о конкретной и существенной опасности для здоровья или безопасности населения, возникающей из-за катастрофического риска. Генеральный прокурор Калифорнии ведёт канал приёма таких сообщений и разъясняет охват закона (Министерство юстиции Калифорнии, 2026).

SB 53 также обязывает охваченных им крупных разработчиков передовых моделей публиковать и соблюдать рамочные программы безопасности ИИ и сообщать об определённых критических инцидентах безопасности. Это значимый механизм на уровне штата, но не универсальная защита: охват определяется тем, как закон определяет разработчика, сотрудника, модель и катастрофический риск. Для реального случая читателям стоит обращаться к принятому тексту закона и к квалифицированным юристам.

Нью-йоркский закон RAISE, подписанный в декабре 2025 года, аналогичным образом установил требования по безопасности и отчётности для передовых моделей в пределах юрисдикции Нью-Йорка (губернатор штата Нью-Йорк). Режимы отдельных штатов могут сближаться, вступать в противоречие друг с другом или становиться предметом судебных разбирательств; актуальный статус нужно проверять отдельно.

Европейский союз добавил канал отчётности

Система правоприменения Закона ЕС об ИИ включает защищённый инструмент для осведомителей, предназначенный для людей, профессионально связанных с поставщиками систем ИИ или моделей общего назначения, чтобы сообщать о предполагаемых нарушениях. Бюро ИИ и национальные органы делят между собой ответственность за правоприменение (Европейская комиссия, август 2026).

Этот инструмент касается нарушений применимого права ЕС, а не любого этического разногласия или умозрительного риска. Защита осведомителей в ЕС и её реализация на национальном уровне также влияют на доступные средства правовой защиты. Канал эффективен только тогда, когда пользователи понимают юрисдикцию, порядок обеспечения конфиденциальности, обращения с доказательствами и защиты от ответных мер.

Что требуется для эффективной внутренней отчётности

У сотрудника должно быть несколько путей: руководитель, независимая функция безопасности или соответствия требованиям, комитет совета директоров и уполномоченный внешний регулятор. Отчётность через ту же управленческую цепочку, которая одобрила спорный релиз, создаёт конфликт интересов. Руководителям направлений безопасности нужен доступ к совету директоров и защита от коммерческих ответных мер.

Политики должны широко определять запрещённые ответные меры: увольнение, понижение в должности, утрату доли в капитале, нежелательные назначения, угрозы, занесение в чёрные списки, миграционное давление и стратегические судебные иски. Подрядчикам, временным работникам, поставщикам услуг red team и исследователям часто нужна такая же защита, поскольку они могут видеть те же доказательства, что и штатные сотрудники.

Сроки подтверждения получения сообщения, обязанности по сохранению доказательств, независимая первичная оценка и письменно зафиксированные результаты делают канал поддающимся проверке. Анонимная отчётность помогает, но анонимность может не сработать из-за технических метаданных или из-за того, что доступ к информации о событии имеет слишком узкий круг людей. Организациям следует минимизировать доступ и честно объяснять ограничения.

Доля в капитале и компенсация могут заставить молчать

Компенсационные пакеты в передовых лабораториях могут включать ценные ещё не перешедшие в собственность (unvested) доли в капитале. Их утрата после увольнения может сделать высказывание опасений финансово разорительным даже без прямой угрозы. Соглашения об увольнении могут добавлять давление в виде обязательств не порочить репутацию компании, конфиденциальности или неразглашения.

Справедливая система должна сохранять уже заработанную компенсацию, предоставлять время и независимую консультацию перед подписанием отказов от претензий, чётко формулировать защищённые права на отчётность и запрещать договорные условия, ставящие экономическую ценность в зависимость от молчания по поводу законных опасений в сфере безопасности. Такие меры защиты снижают принуждение, не разрешая при этом раскрытие несвязанных с этим секретов.

Обращение с доказательствами и ответственная эскалация

Потенциальным осведомителям следует использовать авторизованные каналы и получать юридическую консультацию, прежде чем копировать конфиденциальные данные. Массовое изъятие пользовательских записей, весов моделей, персональной информации или секретных материалов может создать новый вред и юридические риски. Цель — сохранить необходимые доказательства, минимизируя при этом раскрытие несвязанной с делом информации.

Организациям следует вести защищённые от подделки журналы, записи оценок, решения о развёртывании, особые мнения, не совпадающие с общей позицией, и хронологию инцидентов. Такое хранение данных не позволяет опасению превратиться в ситуацию «слово против слова». Регуляторам нужны защищённые помещения и технический персонал, способный изучать доказательства, которые нельзя сделать публичными.

Публичное раскрытие информации иногда может быть оправданным, но оно не является первым безопасным вариантом в каждом случае. Зрелая система предлагает заслуживающие доверия независимые каналы прежде, чем сотрудники почувствуют себя вынужденными выбирать между молчанием и раскрытием чувствительных материалов всему миру.

Как избежать злонамеренных или некачественных сообщений

Защита добросовестной отчётности не требует принятия сфабрикованных доказательств или травли. Первичная оценка может учитывать конкретность, наличие подтверждений, доступ к информации и срочность. Заведомо ложные сообщения могут оставаться наказуемыми, но несогласие или неподтверждённое опасение не следует приравнивать к недобросовестности.

Обратная связь имеет значение. Если сотрудники видят, что их сообщения исчезают без объяснений, они перестанут пользоваться каналом. Агрегированная прозрачность — число обращений, их категории, время расследования, степень подтверждения и корректирующие меры — способна демонстрировать работоспособность системы, защищая при этом личности заявителей.

Почему добровольных обещаний недостаточно

Корпоративная политика может превышать требования закона и быстро адаптироваться. Она также может меняться, не охватывать подрядчиков или применяться людьми с противоречащими стимулами. Юридические права создают внешний минимальный уровень защиты, средства правовой защиты и полномочия по истребованию доказательств через суд. Самая надёжная архитектура сочетает внутреннюю культуру, ответственность совета директоров, каналы связи с регуляторами и юридически принудительные к исполнению правила против ответных мер.

Лаборатории — заинтересованные стороны, когда описывают собственную культуру безопасности. Увольняющиеся сотрудники — тоже заинтересованные стороны с частичной картиной происходящего. Независимые расследования должны оценивать документы и поведение. Череда увольнений — это тревожный сигнал, а не доказательство конкретного обвинения.

Примерная программа политических мер

Правительства могли бы защищать добросовестное раскрытие информации об определённых серьёзных рисках ИИ ещё до нарушения закона; охватывать сотрудников и подрядчиков; сохранять доступ к регуляторам и законодателям; предоставлять конфиденциальность, временные защитные меры, восстановление в должности, возмещение ущерба и компенсацию судебных издержек; и наказывать заведомые ответные меры. Такие правила должны согласовываться с законодательством о безопасности и приватности.

Регуляторам следует публиковать чёткие критерии приёма обращений, защищать чувствительные доказательства, привлекать технических экспертов и сообщать обезличенные результаты. Советам директоров стоит подтверждать, что значимые опасения по безопасности доходили до независимых директоров ещё до развёртывания с высоким риском.

Суть дела

Защита осведомителей относительно недорога по сравнению с обучением или аудитом передовых моделей, но она не возникает автоматически. Калифорния, Нью-Йорк и ЕС теперь предоставляют конкретные механизмы, связанные с ИИ, в пределах своих юрисдикций; охват в других местах остаётся фрагментированным. Мерилом успеха служит не страница с изложением политики. Мерило — это то, могут ли люди представить конкретные доказательства, дойти до независимого следователя, сохранить средства к существованию и свои законные права и добиться исправления ситуации до того, как вред разрастётся.

References

Summarized position

Current and former OpenAI and Google DeepMind employees calls on AI companies not to retaliate against employees who publicly raise safety concerns after other channels fail.

Current and former OpenAI and Google DeepMind employees, "A Right to Warn about Advanced Artificial Intelligence," endorsed by Yoshua Bengio, Geoffrey Hinton, and Stuart Russell
righttowarn.ai, Signed statement
  1. Министерство юстиции Калифорнии, 2026 oag.ca.gov
  2. губернатор штата Нью-Йорк governor.ny.gov
  3. Европейская комиссия, август 2026 digital-strategy.ec.europa.eu

Type to search the manual.

navigate open esc close