Искусственный интеллект и персональные данные: что можно загружать в нейросети

Менеджер вставляет переписку с клиентом в ChatGPT, чтобы бот сформулировал вежливый ответ на жалобу. Кадровик загружает резюме кандидата в нейросеть и просит сделать короткое саммари для руководителя. Маркетолог скармливает Claude выгрузку из CRM с именами, телефонами и суммами покупок, чтобы получить портрет аудитории для рекламной кампании. Все три ситуации происходят в российских компаниях каждый день и выглядят как обычная автоматизация рутины.

С точки зрения закона о персональных данных это не автоматизация, а трансграничная передача персональных данных - причем чаще всего без уведомления Роскомнадзора и без отдельного согласия клиента именно на такую передачу. Тема искусственный интеллект и персональные данные обычно обсуждается абстрактно: этика, точность ответов, будущее профессий. Для оператора персональных данных вопрос конкретнее - что можно вставить в окно запроса зарубежной нейросети, а что нельзя ни при каких условиях, даже если очень нужно быстро закрыть задачу. Дальше по шагам: почему запрос в ChatGPT юридически похож на отправку файла подрядчику за границу, что говорит закон об ии обработке персональных данных и какие есть рабочие варианты - обезличивание перед отправкой, российские модели, локальный запуск.

Важная оговорка сразу: закон не запрещает нейросети как таковые и не требует отказаться от них. Он требует того же, что и от любого другого способа обработки данных - законного основания, уведомления, где оно нужно, и контроля за тем, что именно уходит наружу. Дальше в тексте - конкретные правила по типам данных и по типам сервисов, без общих призывов быть осторожнее.

Почему запрос в сервис искусственного интеллекта - это трансграничная передача персональных данных

Трансграничная передача персональных данных - это их передача на территорию иностранного государства иностранному юридическому или физическому лицу либо иностранному органу власти. Когда сотрудник вставляет текст с именем и телефоном клиента в чат ChatGPT, этот текст уходит на сервер OpenAI в США. Gemini обрабатывает запросы на инфраструктуре Google, чаще всего тоже за пределами России. Claude работает на серверах Anthropic, также в США. В момент отправки сообщения данные покидают страну и обрабатываются иностранной компанией, и не важно, сохранит ли сервис историю переписки или ответит и тут же ее забудет.

Формально акт передачи уже состоялся в момент, когда данные ушли на чужой сервер для обработки. То, что компания не заключала с OpenAI или Google договор и не отправляла файл вложением, ничего не меняет: запрос с персональными данными в текстовом поле нейросети - тоже передача, просто без привычной формы выгрузка, файл, письмо. Отдельная категория риска - специальные категории персональных данных. Если сотрудник клиники вставляет в ChatGPT симптомы и фамилию пациента, чтобы получить черновик заключения, данные о здоровье конкретного человека уходят на сервер в США, а это уже не просто трансграничная передача, а передача специальной категории данных, для которой требования еще строже.

Что говорит закон о трансграничной передаче

Статья 12 закона о персональных данных обязывает оператора уведомить Роскомнадзор до начала трансграничной передачи данных, если она не была заранее описана в общем уведомлении об обработке персональных данных. Отдельно закон делит страны на две группы. В одну входят государства, которые Роскомнадзор считает обеспечивающими надлежащую защиту прав субъектов - список утвержден и периодически обновляется, актуальный порядок и перечень мы разбирали отдельно в статье про трансграничную передачу персональных данных в 2026 году. В другую группу попадают все остальные страны, включая США, где расположены основные дата-центры ChatGPT, Gemini и большинства зарубежных нейросетей.

Передача в страну без надлежащей защиты допускается только при дополнительных условиях: письменное согласие субъекта именно на трансграничную передачу его данных, либо одно из оснований, прямо перечисленных в законе - исполнение договора с самим субъектом, защита его жизни и здоровья, международный договор России и несколько других узких случаев. Типичная ситуация с ChatGPT под эти основания не попадает. У компании обычно нет ни отдельного согласия клиента на передачу его данных в американскую нейросеть, ни уведомления в Роскомнадзор, ни правового основания из перечня. Формально это нарушение статьи 12, и с 2025 года цена такого нарушения выросла: оборотные штрафы, привязанные к выручке компании, действуют наряду со штрафом за отсутствие уведомления об обработке персональных данных как таковой.

Локализация никуда не делась

Отдельно от трансграничной передачи в законе есть требование о локализации: запись, систематизация, накопление, хранение, уточнение и извлечение персональных данных граждан России при их первичном сборе должны выполняться с использованием баз данных, физически расположенных на территории страны. Правило появилось в 2015 году и с тех пор не менялось.

Если компания собирает данные через российскую CRM или сайт на российском хостинге, требование о локализации на этом этапе выполнено. Вопрос возникает дальше: что происходит, когда сотрудник берет уже собранные данные и переносит их фрагмент в интерфейс зарубежной нейросети для обработки. Юристы расходятся в оценке, считать ли это отдельным нарушением локализации или только вопросом трансграничной передачи - закон писался до появления чат-ботов с текстовым интерфейсом, и прямого ответа на этот случай в нем нет. На практике Роскомнадзор в подобных историях смотрит прежде всего на факт передачи данных за границу и на отсутствие согласия или основания для нее, а не на тонкости квалификации по статье о локализации. Ждать точности от формулировки не стоит - безопаснее исходить из того, что оба риска существуют одновременно, и закрывать оба, а не выбирать один для спокойствия. Осторожный подход - относиться к любой передаче данных за пределы российской инфраструктуры, включая разовое копирование фрагмента в чат нейросети, как к событию, которое нужно фиксировать и обосновывать, а не как к техническому нюансу.

Настройки провайдера не решают вопрос трансграничной передачи

OpenAI, Google и Anthropic в пользовательских соглашениях по-разному описывают, что происходит с текстом запроса. У бесплатных потребительских версий ChatGPT и Gemini по умолчанию включена возможность использовать переписку для улучшения модели - с обезличиванием на стороне провайдера, но без гарантии, что фрагмент с именем и телефоном не попадет в обучающую выборку раньше, чем его успеют обезличить. Отключить это можно в настройках аккаунта, но большинство сотрудников не задумывается о такой настройке вообще, потому что не знает о ее существовании.

Корпоративные и API-версии тех же сервисов устроены иначе: в договорах для бизнес-аккаунтов OpenAI и Google обычно прямо указывают, что данные из запросов не используются для обучения модели по умолчанию. Это снимает вопрос про обучение, но не снимает остальные: сервер все равно физически находится за границей, договор с провайдером все равно нужен, а согласие или законное основание для передачи данных конкретного человека все равно требуется отдельно. Смена тарифа с бесплатного на корпоративный решает один риск и оставляет нетронутым другой - собственно трансграничную передачу. Политики провайдеров к тому же меняются быстрее, чем успевает обновиться внутренняя инструкция компании: то, что было верно полгода назад, стоит перепроверять, а не переписывать по памяти.

Какие персональные данные нельзя загружать в зарубежный искусственный интеллект

Проще всего свести правило к списку данных, для которых загрузка в ChatGPT, Gemini, Claude и другие зарубежные сервисы в исходном виде создает нарушение. Таблица ниже - не исчерпывающий перечень, а ориентир для быстрой проверки перед тем, как нажать отправить.

Данные Можно ли отправлять как есть Что делать
ФИО вместе с телефоном или email Нет Заменить на условное имя вроде Клиент 1, убрать контакты
Данные о здоровье, диагнозы, результаты анализов Нет, специальная категория Не отправлять вообще, обрабатывать локально
Резюме кандидата целиком, с контактами и датой рождения Нет Убрать контакты, город проживания и дату рождения перед загрузкой
Скан паспорта, СНИЛС, реквизиты банковской карты Нет, ни при каких условиях Не загружать даже для распознавания текста
Договор с указанием сторон, адресов и банковских реквизитов Нет в исходном виде Заменить стороны на условные обозначения Заказчик и Исполнитель, убрать реквизиты
Обезличенная статистика без привязки к конкретному человеку Да Загружать можно

Строка про обезличенную статистику - не формальность. Если из выгрузки убрать имена, но оставить уникальный номер заказа, редкий город и дату рождения, конкретного человека часто можно вычислить и без имени, просто по совпадению нескольких признаков. Промежуточных решений тут немного: либо данные обезличены по-настоящему, либо их не стоит отправлять в зарубежный сервис вообще.

Обезличивание перед отправкой - рабочий вариант

Обезличивание персональных данных - способ обработки, после которого невозможно определить, какому конкретно человеку принадлежат данные, без использования дополнительной информации. Мы разбирали технику подробно в статье про обезличивание персональных данных - здесь коротко о том, что применимо именно к работе с нейросетями.

Правило простое: обезличивание должно происходить до того, как текст попал в окно запроса нейросети, а не после. Если сотрудник уже вставил фрагмент переписки с именем и телефоном в ChatGPT и только потом спохватился и удалил их из своего черновика, это не помогает: данные уже ушли на сервер в момент отправки. Практические приемы: заменять имена ролями вроде клиент, заявитель, покупатель, округлять даты до месяца, убирать точный адрес до уровня города, вырезать номера заказов и договоров, заменять суммы диапазонами. Для большинства рабочих задач - составить черновик ответа, сделать выжимку из большого текста, проверить формулировку договора - смысл запроса от такой замены не страдает. Нейросети не нужно реальное имя человека, чтобы предложить вежливую формулировку отказа или пересказать длинный документ.

Отдельно стоит проговорить с сотрудниками, что обезличивание касается не только имени. Уникальные детали вроде должности в маленькой компании, редкой профессии или единственного в городе адреса магазина иногда выдают человека надежнее, чем фамилия.

Чат-боты на сайте и накопленные логи

Отдельная история - не ручной ввод сотрудником, а чат-бот на сайте компании, который под капотом использует зарубежную языковую модель для ответов посетителям. Здесь оператором остается сама компания, а не разработчик виджета, и все, что посетитель написал боту - имя, телефон, суть обращения - проходит через ту же цепочку трансграничной передачи, только автоматически и в большем объеме, чем при ручном копировании сотрудником. Типичные ошибки при внедрении таких ботов и то, где чаще всего находят нарушения при проверке, мы разбирали в статье про чат-ботов и сбор персональных данных.

Проблема усугубляется тем, что переписку с ботом обычно никто не читает построчно: диалоги накапливаются автоматически, и через полгода в логах может обнаружиться персональная информация, которую туда никто сознательно не закладывал - адрес, диагноз, номер паспорта, который посетитель вписал в свободное поле, объясняя ситуацию. Если чат-бот работает на зарубежной модели, весь этот массив уже прошел трансграничную передачу, причем без какого-либо контроля на входе. Разобраться с этим постфактум сложнее, чем настроить фильтр заранее.

Российский искусственный интеллект снимает не все риски для персональных данных

YandexGPT и GigaChat работают на инфраструктуре, физически расположенной в России, и снимают проблему трансграничной передачи - данные не покидают страну. Но это не делает их использование законным по умолчанию. Разработчик такой модели - тоже третье лицо, которому компания поручает обработку персональных данных, и общее правило закона о поручении обработки другому лицу с этим третьим лицом никуда не девается. Нужен договор, где прописаны цель обработки, перечень действий, которые может выполнять исполнитель, требования к конфиденциальности и обязанность уведомить оператора об инциденте. Мы отдельно разбирали, когда такой договор обязателен и что в нем должно быть, в статье про договор поручения на обработку персональных данных.

Есть и вторая тонкость, общая для российских и зарубежных сервисов: бесплатная потребительская версия чат-бота часто по умолчанию использует переписку для дообучения модели, и это отдельный вопрос от страны расположения серверов. Корпоративные тарифы обычно дают возможность отключить сохранение истории и использование диалогов для обучения - эту настройку стоит проверить и включить независимо от того, российский сервис или зарубежный. Показательный случай: онлайн-школа перешла с ChatGPT на GigaChat для проверки домашних заданий, но не подписала с оператором сервиса договор поручения и не указала GigaChat в перечне лиц, которым передаются данные учеников, в своей политике обработки. Риск трансграничной передачи исчез, а формальное нарушение осталось - просто другое.

Локальный запуск модели на своей инфраструктуре

Для компаний с большим потоком чувствительных данных - клиник, HR-платформ, финансовых сервисов - есть вариант без третьих лиц вообще: развернуть открытую модель на собственных серверах, физически расположенных в России. В этом случае данные не покидают инфраструктуру компании ни на одном этапе, поручение обработки постороннему лицу не требуется, а трансграничная передача исключена по построению.

У варианта есть цена. Локальный запуск требует серверов с достаточным объемом видеопамяти, инженеров, которые умеют разворачивать и поддерживать такие модели, и готовности к тому, что открытые модели пока чаще уступают лучшим коммерческим сервисам по качеству ответов на сложных задачах. Для рутинных сценариев - классификация обращений, извлечение данных из типовых документов, генерация черновиков по шаблону - разница в качестве обычно не критична, а выигрыш в защищенности данных перекрывает разницу в удобстве. Для компании без своего it-отдела это скорее задача на аутсорс, чем на выходные силами штатного программиста. Пример из практики: сеть стоматологических клиник вместо отправки истории болезни в ChatGPT развернула открытую модель на арендованном сервере в московском дата-центре и настроила ее на составление черновиков заключений по шаблону. Врачи проверяют и правят текст вручную, но черновая работа ускорилась в разы, а данные пациентов ни разу не покинули инфраструктуру клиники.

Когда нейросеть сама принимает решение о человеке

Отдельно закон регулирует ситуацию, где нейросеть не просто помогает сотруднику, а сама выносит решение, которое касается конкретного человека. Статья 16 запрещает принимать решения, порождающие юридические последствия для субъекта персональных данных или иначе существенно затрагивающие его права, исключительно на основании автоматизированной обработки - без участия человека, без исключений, которые прямо предусмотрены законом или согласием субъекта.

Под это подпадает больше сценариев, чем кажется на первый взгляд: автоматический скоринг заявки на рассрочку, отказ по резюме на основании ответа языковой модели без просмотра резюме человеком, отклонение заявления на возврат чат-ботом без передачи оператору. Например, интернет-магазин настраивает бота так, чтобы он сам одобрял или отклонял заявки на возврат по описанию проблемы - это уже автоматизированное решение с юридическими последствиями для покупателя. Если в компании такой процесс есть, у субъекта должна оставаться возможность заявить свою позицию и потребовать пересмотра решения человеком, а не алгоритмом. Мы подробно писали о требованиях к автоматизированной обработке и о том, как оформить процесс так, чтобы он не нарушал статью 16, в статье про автоматизированную обработку персональных данных. Похожая логика применима к найму: если рекрутинговый сервис на основе нейросети отсеивает резюме до того, как их увидит человек, кандидат вправе потребовать объяснения и пересмотра отказа.

Кто отвечает за нарушение: компания или сотрудник

Ответственность за нарушение закона о персональных данных несет оператор - компания или индивидуальный предприниматель, а не конкретный сотрудник, который вставил данные в чат нейросети. Роскомнадзор и суд будут разбираться с юридическим лицом, даже если решение вставить данные в ChatGPT сотрудник принял сам, без указания руководства и в нарушение внутренних правил, если такие правила вообще существуют.

Это не значит, что сотрудник ни при чем. Работодатель вправе применить дисциплинарную ответственность за нарушение внутренних инструкций - от замечания до увольнения, в зависимости от тяжести и повторности. Но эта ответственность существует отдельно от ответственности перед Роскомнадзором и никак не уменьшает штраф для самой компании. Отсюда практический вывод: полагаться на устную договоренность или общую фразу в трудовом договоре про соблюдение законодательства бессмысленно. Правило про нейросети должно быть зафиксировано письменно - в положении об обработке персональных данных или в отдельной инструкции, с которой сотрудника знакомят под подпись. Тогда у компании есть основание не только наказать нарушителя внутри, но и показать проверяющему, что политика существует и доводится до сотрудников, а конкретный случай - исключение, а не системная практика.

Что делать, если сотрудники уже пользуются нейросетями

Запрещать нейросети целиком - не рабочий вариант: сотрудники все равно будут ими пользоваться, просто с личных аккаунтов и без какого-либо контроля со стороны компании. Практичнее навести порядок в том, что можно передавать, а что нет, и закрепить это не на словах, а в документах.

  1. Провести короткий аудит: какие отделы и для каких задач используют ChatGPT, Gemini, Claude, YandexGPT или другие сервисы - обычно выясняется, что список шире, чем предполагало руководство.
  2. Составить и разослать сотрудникам короткий список данных, которые нельзя вставлять в чужой интерфейс ни в каком виде - за основу можно взять таблицу выше.
  3. Добавить в положение об обработке персональных данных отдельный пункт про использование нейросетей и внешних ии-сервисов, если такого пункта пока нет.
  4. Проверить в корпоративных аккаунтах настройки хранения истории и использования диалогов для обучения модели, отключить там, где это возможно.
  5. Для процессов с высокой чувствительностью данных - медицина, финансы, кадры - рассмотреть переход на российскую модель с оформленным договором поручения либо на локальный запуск.
  6. Если есть основания подозревать, что данные уже ушли в зарубежную нейросеть без обезличивания, зафиксировать это как инцидент и оценить, требуется ли уведомление Роскомнадзора.

Большая часть этой работы - не про технологии, а про документы: положение об обработке персональных данных, договоры поручения, согласия, которые честно описывают, куда уходят данные клиента. Сайт 152fzpro.ru занимается именно этим - готовит документы и дорабатывает сайты под требования закона о персональных данных, без обещаний, что нейросети сами по себе сделают компанию защищенной.

Частые вопросы

Можно ли вставлять данные клиента в ChatGPT для рабочих задач?

Нет, если данные не обезличены заранее. Запрос с именем, телефоном или диагнозом уходит на сервер за границей - это трансграничная передача персональных данных, для которой обычно нет ни согласия субъекта, ни уведомления Роскомнадзора. Перед отправкой в зарубежную нейросеть данные нужно заменить условными обозначениями, например Клиент 1 вместо имени.

Снимает ли переход на российскую нейросеть все риски по 152-ФЗ?

Не полностью. YandexGPT и GigaChat убирают риск трансграничной передачи, потому что серверы расположены в России. Но разработчик модели остается третьим лицом, которому поручена обработка данных, и с ним нужен договор поручения с описанием цели, действий и обязанности уведомлять об инцидентах. Без договора формальное нарушение сохраняется, просто другое.

Кто отвечает за нарушение, если данные в нейросеть вставил сотрудник?

Отвечает компания как оператор персональных данных, а не конкретный сотрудник, даже если он действовал без указания руководства. Работодатель вправе применить к нему дисциплинарное взыскание за нарушение внутренних правил, но это не уменьшает ответственность компании перед Роскомнадзором. Поэтому правило про нейросети стоит закрепить письменно и знакомить сотрудников под подпись.

Можно ли доверить чат-боту самому одобрять или отклонять заявки клиентов?

Нет, без участия человека нельзя. Статья 16 закона запрещает принимать решения с юридическими последствиями для человека исключительно на основании автоматизированной обработки, без исключений из закона или согласия субъекта. Если чат-бот сам отклоняет заявку на возврат, у клиента должна быть возможность потребовать пересмотра решения человеком.