Перейти к содержимому
Все статьи

Как убрать личные данные из текста перед отправкой нейросети

Как подготовить копию текста для ИИ: убрать идентификаторы, сохранить смысл задачи и проверить косвенные детали. Примеры на вымышленных данных.

3 октября 2026 г.данныеконфиденциальностьпромпты
Карточки с этапами составления запроса и проверки результата

Для редактуры письма нейросети обычно не нужны настоящее имя человека, номер заказа и точный адрес. Эти сведения можно убрать из рабочей копии до отправки. Главное — сохранить отношения, от которых зависит задача, и не считать простую замену имени полной анонимностью.

Ниже разобрана техническая подготовка текста, а не юридическая оценка допустимости его передачи. Все примеры вымышлены. Если документ содержит закрытые сведения организации, сначала определите разрешённый способ работы с ним; удаление нескольких имён не превращает любой материал в открытый.

Уберите лишнее до загрузки

Создайте копию исходника локально. Удалите подписи, номера телефонов, адреса, идентификаторы и ссылки с персональными параметрами, если они не нужны для задачи. Проверьте также имя файла, комментарии и скрытые листы: содержание не всегда ограничено видимым абзацем.

Не отправляйте полный чувствительный документ во внешний чат с просьбой сначала его обезличить. В таком случае передача уже произошла. Подготовку выполняйте вручную или разрешённым локальным инструментом до загрузки.

Сохраняйте одинаковые обозначения для одного и того же участника. Если в первом абзаце он «Клиент A», во втором не превращайте его в «Клиента B». Иначе модель не сможет правильно проследить последовательность событий.

Сохраните смысл задачи

Для анализа порядка действий могут быть важны интервалы между событиями, но не календарные даты. Тогда можно заменить даты на «день 1» и «день 3». Для редактуры тона письма часто не нужны и интервалы: оставьте только формулировку проблемы.

Следующий промпт получает уже подготовленный вымышленный текст:

Отредактируй письмо, сохранив спокойный деловой тон. Метки Клиент A, Заказ X и День 3 — условные обозначения. Не пытайся восстановить реальные имена, даты или номера. Не добавляй обстоятельств, которых нет в тексте.

Письмо: Клиент A, по Заказу X мы получили ваше уточнение в День 3. В исходном списке указаны два предмета, а в уточнении три. Подтвердите, пожалуйста, какой список считать актуальным.

Проверять промпт для обезличивания в выбранной нейросети стоит на полностью вымышленном фрагменте. Сравните, какие идентификаторы были убраны и сохранился ли смысл задачи. Формулировку для изображения можно опробовать в генераторе «Промт Для», выбрав модель под свою задачу.

Здесь отношения между двумя версиями списка сохранены. Реальные идентификаторы не нужны, чтобы сделать письмо понятнее. После редактуры вы можете вернуть необходимые реквизиты в локальной копии, проверив соответствие меток.

Посмотрите на косвенные признаки

Человек может быть узнаваем по сочетанию редкой должности, точного события и маленького населённого пункта даже без имени. Поэтому проверьте, какие детали действительно влияют на задачу. Обобщите ненужные признаки до роли или типа ситуации.

Проверь этот синтетический пример на лишнюю детализацию для задачи редактуры. Не определяй личность и не ищи совпадения в интернете. Назови сведения, которые можно заменить более общими формулировками без потери смысла.

Пример: Единственный организатор ежегодной выставки в маленьком посёлке написал участнику о переносе встречи на конкретную дату. Нужно сделать сообщение короче и вежливее.

Ответ: список деталей для удаления или обобщения и объяснение, почему они не нужны для редактуры.

Такая проверка на вымышленном примере помогает составить собственный список правил. Она не доказывает безопасность реального набора данных и не заменяет просмотр человеком.

Не полагайтесь только на автоматическое обнаружение

Инструменты могут пропускать необычные имена, номера и косвенные признаки. Например, документация Presidio прямо указывает, что автоматическое обнаружение не гарантирует нахождение всех чувствительных сведений. Проверяйте результат и на содержательном уровне.

Если для задачи необходимо сохранить сложные идентификаторы, подумайте, можно ли заменить реальный документ синтетическим примером той же структуры. Для проверки формулы или стиля это часто достаточно.

Чётко отделяйте данные от инструкций и передавайте только контекст, который влияет на результат. Это делает запрос одновременно понятнее и компактнее.

Вернувшись к своему запросу в выбранной нейросети, используйте только вымышленный пример и проверьте, достаточно ли контекста осталось в задаче.

Для работы с изображениями и видео откройте генератор ПромтДля. Доступные модели, параметры и стоимость показаны в форме перед запуском.