Словарь ИИ

Что такое персонально идентифицируемая информация

Что такое персонально идентифицируемая информация

Персонально идентифицируемая информация, или PII (Personally Identifiable Information), — это данные, по которым можно установить личность человека напрямую или в сочетании с другими сведениями. К таким данным относятся, например, полное имя, номер документа, адрес электронной почты, номер телефона и иные признаки, связанные с конкретным человеком.

Чем больше цифровых сервисов используют люди и компании, тем больше таких данных передаётся при регистрации, покупках, обращении в банк, клинику или онлайн-платформу. Это создаёт удобство, но одновременно повышает риск утечек, кражи личности и мошенничества.

Содержание статьи

Какие данные считаются персонально идентифицируемой информацией

PII — это не любые личные сведения, а именно те данные, которые позволяют определить человека. Иногда для этого достаточно одного признака, а иногда — только набора нескольких признаков.

Самый простой пример — номер паспорта или иного удостоверения личности. Такой идентификатор обычно связан с одним человеком и сам по себе указывает, кто перед нами. Но бывают и менее очевидные случаи: дата рождения, город проживания и адрес электронной почты по отдельности могут не идентифицировать человека, а вместе уже сужают круг до конкретной персоны.

Поэтому PII рассматривают не только как набор «секретных» данных, но и как контекст. Один и тот же элемент может быть безобидным в одной ситуации и чувствительным в другой.

Чем прямые идентификаторы отличаются от косвенных

Прямые идентификаторы позволяют установить личность без дополнительных шагов. Косвенные идентификаторы сами по себе человека обычно не раскрывают, но в комбинации с другими данными могут это сделать.

К прямым идентификаторам относят уникальные данные: номер паспорта, номер водительского удостоверения, биометрические шаблоны, номер государственного документа. Один такой признак часто уже достаточен для точной идентификации.

Косвенные идентификаторы шире и встречаются чаще. Это дата и место рождения, пол, национальность, адрес, сведения о работе, номер телефона, электронная почта, географические данные.

Проблема в том, что сочетание нескольких косвенных признаков может оказаться не менее чувствительным, чем один прямой идентификатор. Именно поэтому утечки «несекретных» на первый взгляд данных тоже опасны.

Чем чувствительная PII отличается от нечувствительной

Чувствительная PII — это данные, утечка которых может привести к серьёзному вреду: финансовому ущербу, захвату аккаунтов, мошенничеству или раскрытию медицинской и иной частной информации. Нечувствительная PII тоже связана с человеком, но по отдельности обычно не даёт злоумышленнику таких возможностей.

Граница между этими категориями не всегда жёсткая. Она зависит от того, где именно используются данные, с чем они связаны и можно ли по ним получить доступ к сервисам, документам или счетам.

Что относится к чувствительной PII

Чувствительной обычно считают информацию, которая напрямую подтверждает личность или открывает доступ к важным системам и услугам.

  • номера удостоверяющих документов;
  • биометрические данные, включая отпечатки пальцев и сканы сетчатки;
  • банковские реквизиты и данные платёжных карт;
  • медицинские записи и история лечения.

Такие сведения, как правило, не находятся в открытом доступе. Поэтому организации обязаны ограничивать к ним доступ, шифровать их и контролировать способы хранения и передачи.

Что относится к нечувствительной PII

Нечувствительная PII может указывать на человека, но сама по себе не всегда позволяет украсть личность или получить доступ к критичным ресурсам.

  • полное имя;
  • номер телефона;
  • дата рождения;
  • место рождения;
  • адрес электронной почты или почтовый адрес;
  • IP-адрес;
  • географические сведения, включая город, регион и индекс;
  • данные о работе;
  • раса, этническая принадлежность, религия;
  • девичья фамилия матери;
  • имя аккаунта в социальной сети.

Часть таких данных может быть публичной. Но если собрать их в один профиль, картина становится совсем другой. Номер телефона, почта и ответ на контрольный вопрос уже могут помочь при взломе аккаунта или обходе проверки личности.

Когда обычные данные становятся PII

Данные становятся PII тогда, когда по ним можно определить конкретного человека. Это зависит не только от самих сведений, но и от того, какие дополнительные источники доступны для сопоставления.

Например, обезличенные геоданные в агрегированном виде часто не считаются персонально идентифицируемой информацией, потому что из них нельзя выделить одного пользователя. Но отдельные записи о перемещениях устройства уже могут позволить понять, где человек живёт, работает и с кем регулярно пересекается.

Если к таким данным добавить открытые реестры, сведения из социальных сетей или публичные адресные записи, идентификация становится реальной. По этой причине границы понятия PII со временем смещаются: технологии анализа данных делают повторную идентификацию проще, чем раньше.

Почему персонально идентифицируемая информация так важна

PII интересует злоумышленников, потому что её можно использовать для кражи личности, шантажа, захвата аккаунтов и подготовки более крупных атак. Даже неполный набор данных может стать отправной точкой для мошенничества.

Чужие персональные данные применяют по-разному. Иногда их продают на теневых площадках. Иногда используют в целевых фишинговых письмах, чтобы письмо выглядело правдоподобно. В других случаях PII становится частью вымогательства после взлома.

Отдельный риск связан с социальной инженерией. Человек сам может раскрыть лишние сведения в переписке, по телефону или в соцсетях, не воспринимая их как ценные. Но злоумышленник собирает фрагменты как пазл.

Именно поэтому даже сведения, которые не кажутся секретными, нельзя оценивать в отрыве от контекста и возможных комбинаций.

Как законы и стандарты трактуют PII

Единого глобального определения PII нет. Разные страны, регуляторы и отраслевые стандарты по-разному определяют, какие данные надо защищать и в каком объёме.

В международной практике часто используют широкий подход. Например, европейский GDPR защищает персональные данные как любую информацию, относящуюся к идентифицированному или идентифицируемому человеку. Под такую формулировку подпадает больше данных, чем под узкое понимание PII.

В США подход долгое время был уже: в центре внимания находились конкретные идентификаторы вроде имени, адреса, номера социального страхования, водительского удостоверения или банковских реквизитов. При этом существуют отдельные акты и правила для госорганов, штатов и отраслей.

Есть и отраслевые стандарты. В здравоохранении действуют отдельные правила для защиты медицинских данных. В платёжной сфере — требования к обработке карточной информации. Это означает простую вещь: один и тот же набор данных может подпадать сразу под несколько режимов защиты.

Какие трудности возникают у компаний при работе с PII

Главная трудность — PII редко хранится в одном месте. Данные собираются через сайты и приложения, передаются в облака, обрабатываются в разных системах и используются сотрудниками из разных подразделений.

Из-за этого компаниям сложно ответить даже на базовые вопросы: какие именно персональные данные у них есть, где они лежат, кто имеет к ним доступ и зачем они вообще сохраняются. Без такой карты данных невозможно выстроить защиту и соблюсти требования регуляторов.

Ситуацию усложняют облачные сервисы, SaaS-платформы, удалённая работа и интеграции с внешними подрядчиками. Данные могут собираться в одной юрисдикции, храниться в другой, а обрабатываться в третьей. Для каждой точки цепочки действуют свои правила.

Как защищать персонально идентифицируемую информацию

Защита PII строится на трёх принципах: знать, какие данные есть; собирать только нужное; ограничивать доступ и снижать последствия утечки. Без этой базы даже дорогие средства защиты работают фрагментарно.

Обычно организации выстраивают внутреннюю модель работы с данными: определяют типы PII, уровень чувствительности, сроки хранения, правила удаления и сценарии реагирования на инциденты. Набор мер зависит от того, какие именно сведения обрабатываются и какие требования нужно выполнять.

Базовые шаги по защите PII

Практический подход обычно начинается с инвентаризации и классификации данных, а затем дополняется организационными и техническими мерами.

  1. Найти все места, где хранится и обрабатывается PII.
  2. Сократить сбор данных до действительно необходимых.
  3. Разделить данные по уровням чувствительности.
  4. Настроить меры защиты для каждого типа данных.
  5. Подготовить план действий на случай утечки или взлома.

Какие меры применяются чаще всего

Надёжная защита PII обычно сочетает несколько уровней контроля. Одного механизма недостаточно, потому что утечки происходят и из-за атак, и из-за ошибок сотрудников, и из-за неверной настройки систем.

  • Шифрование. Используется для защиты данных при передаче и хранении.
  • Управление доступом. Доступ получают только те сотрудники и сервисы, которым он нужен по работе.
  • Многофакторная аутентификация. Снижает риск несанкционированного входа в системы с PII.
  • Обучение сотрудников. Помогает снизить число ошибок при обработке данных и распознавании фишинга.
  • Анонимизация. Удаляет или маскирует признаки, по которым можно определить человека.
  • Инструменты предотвращения утечек. Помогают отслеживать движение данных и замечать подозрительные действия.

При этом уровень защиты должен соответствовать типу данных. Для критичных наборов мер нужно больше, для менее чувствительных — меньше. Иначе процессы становятся громоздкими и мешают работе без заметного выигрыша в безопасности.

Как быстро понять, относится ли информация к PII

Если данные позволяют установить личность сами по себе или вместе с другими доступными сведениями, это PII. При оценке нужно смотреть не только на отдельное поле, но и на контекст его использования.

Тип данных Может быть PII Почему
Полное имя Да Указывает на человека, особенно вместе с другими признаками
Номер паспорта Да Прямой уникальный идентификатор
IP-адрес Да, в зависимости от контекста Может быть связан с конкретным пользователем
История просмотров без связи с личностью Не всегда Сама по себе может не позволять определить человека
Геолокация отдельного устройства Да, в ряде случаев Может помочь установить адрес проживания и личность
Медицинская запись Да Связана с конкретным человеком и относится к чувствительным данным

Главное о PII

Персонально идентифицируемая информация — это данные, по которым можно определить человека прямо или косвенно. Опасность таких данных зависит не только от их вида, но и от контекста, комбинации с другими источниками и способов использования.

Поэтому защита PII — это не вопрос одного списка «секретных полей». Нужны учёт данных, их классификация, ограничение доступа, обучение сотрудников и понимание того, как меняется риск повторной идентификации по мере развития технологий.