Нейросети сегодня способны генерировать тексты, создавать изображения и предсказывать поведение рынков. Кажется, что для алгоритма нет ничего невозможного. Однако существует невидимая черта, за которую машинное обучение не может зайти безнаказанно. Эта черта — 152-ФЗ «О персональных данных».
Законодательство четко определяет зоны, где применение ИИ ограничено или требует выстраивания сложнейших юридических конструкций.
Биометрия без права на ошибку
Любая система распознавания лиц, голоса или походки работает с биометрическими персональными данными (БПД). По закону их обработка допускается только в строго определенных случаях: например, при осуществлении правосудия, в рамках задач обороны и безопасности или при наличии письменного согласия субъекта. Просто так запустить Face ID на входе в офисный центр, обучив модель на фотографиях сотрудников из соцсетей, нельзя. Для этого требуется отдельное, осознанное согласие именно на обработку БПД, которое сотрудник имеет право отозвать в любой момент, а компания обязана будет удалить его цифровой слепок.
«Проклятие размерности» и требование локализации
Чтобы быть точным, искусственному интеллекту нужны массивы информации. Но если эти массивы содержат ФИО, адреса почты, номера телефонов или историю заказов граждан РФ, вступает в силу правило первичной локализации. Данные должны физически находиться на серверах внутри страны. Облачные сервисы иностранных разработчиков нейросетей (AWS, Azure) автоматически становятся нелегальным инструментом, если через них транзитом проходят персональные данные россиян для дообучения модели. Даже если сама сеть развернута локально, передача весов или фрагментов датасета за границу для аналитики — прямое нарушение закона.
Запрет на цифровую сегрегацию
Алгоритмы склонны находить скрытые корреляции. Нейросеть может заметить, что люди определенного возраста или района проживания чаще допускают просрочки по кредитам, и начнет отказывать им превентивно. Закон запрещает принимать юридически значимые решения, затрагивающие права человека, исключительно на основании автоматизированной обработки данных. У гражданина должно остаться право на человеческое вмешательство: возможность оспорить вердикт машины, потребовать пересмотра дела специалистом и получить объяснение логики алгоритма простым языком. Это напрямую касается скоринга, HR-фильтров и систем кредитного рейтинга.
Чувствительные данные и врачебная тайна
Особый периметр защиты очерчен вокруг сведений о здоровье, интимной жизни и политических взглядах. Именно здесь ярче всего проявляется конфликт между прогрессом и приватностью. Например, искусственный интеллект в медицине способен анализировать снимки МРТ точнее консилиума врачей и предсказывать развитие редких генетических заболеваний. Но чтобы научить его это делать, разработчикам нужны деперсонализированные, но все же исходные медицинские карты пациентов. Передача таких данных сторонней ИТ-компании даже для создания спасительного медицинского софта возможна либо в полностью обезличенном виде (когда обратный идентификатор уничтожен), либо через сложную конструкцию договора поручения с клиникой, где каждый байт информации защищен режимом коммерческой и врачебной тайны. Любая утечка ставит крест на проекте и грозит уголовной ответственностью.
Проблема «черного ящика»
Глубокие нейронные сети часто сами не могут объяснить, почему приняли то или иное решение. С точки зрения Роскомнадзора и судов, невозможность предоставить человеку информацию об условиях обработки его данных и логике принятого в отношении него решения — самостоятельный риск. Если бизнес использует сложную архитектуру трансформера, он обязан внедрить методы интерпретируемого ИИ (XAI), способные обосновать результат перед регулятором.
Когда дата-сеты стареют быстрее политики конфиденциальности
Еще одно ограничение связано со сроками хранения. Цель сбора должна быть конкретной, а срок — ограниченным. Хранить пользовательские данные вечно «на случай, если они пригодятся для обучения следующей версии модели» незаконно. Как только цель достигнута, информация подлежит уничтожению или полному обезличиванию, причем факт удаления должен быть документально зафиксирован.
Главный вывод прост: нейросеть не является субъектом права, у нее нет паспорта и она не несет ответственности. Ответственность всегда лежит на владельце сервиса. Прежде чем скармливать алгоритмам сырые данные пользователей в погоне за точностью прогноза, стоит задать себе один вопрос: смогу ли я в случае проверки доказать регулятору законность каждой запятой в собранном дата-сете? В эпоху тотальной слежки самым дефицитным ресурсом становится легальный датасет.
