Может ли ИИ реально докладывать «товарищу майору» и что лучше никогда не писать в чатах

Мы привыкли считать генеративный ИИ отличным собеседником и нередко делимся с ним самым сокровенным. Однако чат-боты вовсе не гарантируют конфиденциальности. Больше того — они могут рапортовать о пользователе компетентным органам.
Савва Сафонов
Савва Сафонов
Может ли ИИ реально докладывать «товарищу майору» и что лучше никогда не писать в чатах
Magnific

Наверняка вы уже слышали, как Claude AI донес на пользователя — ну или спас жизни полицейских, это как посмотреть. В двух словах напомним: женщина из Флориды в переписке с ИИ-платформой от Anthropic поделилась планами устроить стрельбу в офисе шерифа округа Ли, а потом еще и сообщила о покупке оружия. Claude отправил рапорт работающим в Anthropic людям-экспертам, а те связались с правоохранительными органами. Даму арестовали, предъявив ей обвинение в письменной угрозе насилия.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Это один из первых громких задокументированных случаев, когда угроза, высказанная в чате с генеративным ИИ, прошла путь от автоматического «флага» до проверки специалистами, обращения компании в полицию и заведения уголовного дела.

Мы разобрались, в каких ситуациях ваш любимый ИИ-собеседник может докладывать «товарищу майору» и получили интересные результаты.

Угрозы плюс оружие

Похоже, что случившееся с Карли Мишель Хеллер (так зовут гражданку из Флориды) было почти неизбежно. В опубликованной Политике использования Anthropic прямо указано, что данные пользователя могут быть переданы правоохранительным органам в экстренных случаях, связанных с риском смерти третьих лиц, нанесения им тяжких телесных повреждений или вообще ведением противозаконной деятельности.

Продолжение ниже Продолжение

Критерии для определения опасности — конкретика угроз и упоминание о приобретении оружия. Если бы Хеллер написала, что готова застрелить из своего нового пистолета любого полицейского, Claude AI мог бы ограничиться успокаивающими речами. И если бы она заявила чат-боту, что купила скалку и собирается забить ей шерифа округа Ли и весь его офис до смерти, система тоже могла воздержаться от рапорта. Впрочем, это не точно — Anthropic не публикует конкретную формулу для запуска тревожного сценария. И в любом случае окончательное решение о передаче информации в полицию остается за экспертной группой из специалистов по политике компании, правоприменению, продукту, data science и оценке рисков.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ
РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Почти все ИИ готовы докладывать об опасных заявлениях

Другие западные LLM тоже ориентированы на общественную безопасность в ущерб приватности. Для Perplexity и Gemini создателями прямо заявлена возможность передачи информации и личных данных пользователя при угрозе нанесения им вреда другим людям. А OpenAI для ChatGPT даже делает на этом акцент — в том смысле, что есть четкий протокол передачи данных.

Другое дело, что в 2026 году для России это не очень актуально. Маловероятно, что сообщение о преступных намерениях (или фантазиях) дойдет от иностранных сервисов до российской полиции. Впрочем, выплескивать агрессию в чат с ИИ все равно чревато. Если в смартфоне пользователя будут найдены записи о подготовке противоправных действий, это послужит доказательством его вины. При этом для доступа к вашему смартфону отечественным правоохранителям сегодня даже судебное постановление иметь не обязательно: достаточно случайно оказаться в месте проведения следственных действий. Например, при осмотре места преступления.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ
чат-бот
Magnific

Что в России?

Для отечественной Алисы публичного обязательства Яндекса сообщать о выявленных угрозах мы не обнаружили. Сама Алиса утверждает, что в ней нет соответствующих механизмов автоматической сигнализации. Максимум, что она может сделать, — воззвать к здравомыслию пользователя и порекомендовать ему, куда можно обратиться в сложной психологической ситуации. Однако есть нюансы.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ
РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Во-первых, по российскому законодательству гражданин обязан сообщить куда следует, если узнал о подготовке теракта конкретным лицом (и кто там будет разбираться, точно ли речь о теракте, или о чем-то похожем?). При этом Яндекс оставляет за собой право использовать ваши запросы к Алисе, предоставляя к ним доступ неограниченному кругу лиц. В том числе без сохранения анонимности. Это указано в «Условиях использования Сервиса "Алиса AI"», пункт 4.3.

И во-вторых — интересный случай годичной давности. В 2025 году Яндекс оштрафовали на 10 000 рублей за отказ предоставить ФСБ доступ к системе умного дома под управлением Алисы. При этом запрос силовиков не был подкреплен судебным постановлением, потому что... не нуждался в нем. Согласно постановлению «О Правилах хранения организаторами распространения информации в информационно-телекоммуникационной сети "Интернет"...» эти самые организаторы обязаны предоставлять данные «уполномоченным государственным органам, осуществляющим оперативно-розыскную деятельность или обеспечение безопасности Российской Федерации». И суд признал, что требование ФСБ предоставить доступ к умному дому было законным.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Бдительность ИИ — это хорошо или нет?

Конечно, сама по себе идея остановить убийцу, передав его переписку с чат-ботом полиции, выглядит гуманно по отношению к его потенциальным жертвам.

Но тут возникает проблема. Получив переписку с описанием намерений совершить конкретное преступление, о ней надо бы сообщить полиции — даже с общечеловеческой точки зрения. В свою очередь, правоохранительные органы в такой ситуации должны как-то реагировать. А в суде переписка становится доказательством умысла. Нюансы зависят от законодательства страны, но чаще всего — так.

Однако криминальная запись в чате с ИИ еще не значит, что человек реально собирается действовать. Это может быть сигналом эмоционального неблагополучия или игрой нездоровой фантазии.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Что из всего этого следует? Как минимум то, что стоит читать пользовательские соглашения перед тем, как ставить галочку о согласии с политикой разработчика. А как максимум — нигде и никогда не писать того, чего вы не готовы высказать прилюдно.

Загружаем