По информации СМИ, российские IT-компании попросили Минцифры доработать закон о персональных данных. В Ассоциации больших данных (АБД, включает «Авито», «Сбер», «Ростелеком», «Яндекс», HH, VK и другие) попросили ведомство разрешить компаниям обрабатывать данные с использованием технологий повышения приватности без согласий граждан для разработки, обучения и использования ИИ, при соблюдении определённых условий.
В АБД пояснили СМИ, что при корректном применении такой подход абсолютно исключает возможность идентификации конкретного пользователя. «Проблема в том, что в действующей нормативной базе эти технологии как отдельная категория не поименованы — любое математическое или алгоритмическое преобразование персональных данных сегодня одинаково относится к „методам обезличивания“. В результате зрелые решения, обеспечивающие реальную защиту человека, юридически не отличаются от промежуточных», — уточнили в АБД.
Технологии повышения приватности (Privacy Enhancing Technologies — PETs) — набор математических и программных методов защиты личных данных, позволяющих обрабатывать, передавать и хранить информацию без риска ее утечки или раскрытия.
В АБД в качестве условий использования PETs предлагается считать, что:
-
риск раскрытия личности равен нулю или не превышает малые доли процента;
-
данные используются только для разработки, обучения и использования ИИ;
-
обработка данных происходит на территории РФ и российскими компаниями;
-
необходимо ввести понятие «доверенного посредника», который аккредитован госорганами и эксплуатирует информсистему для хранения и доступа к обезличенным персональным данным для ИИ.
-
нужно разделить данные на платные и бесплатные — для исполнения требований законодательства и для коммерческого использования.
Комментарии профильных экспертов по этой ситуации:
-
партнёр инвестиционно-технологической компании Zarya Ventures Александр Пономарев: при наличии понятных правовых рамок и гарантий защиты данных такая мера может способствовать развитию российского ИИ-рынка, поскольку доступ к качественным данным остаётся одним из главных ограничений для обучения современных моделей. Рынок данных в России пока развит слабо, большинство датасетов остаётся внутри крупных экосистем;
-
директор по развитию бизнеса Just AI Светлана Захарова: по большей части компании до этого времени использовали те датасеты, которые были им доступны из своих внутренних источников, дочерних компаний, партнёрских проектов. Но уже сейчас очевидно, что этих данных становится недостаточно, поэтому корпорации и пытаются найти новые источники;
-
представитель MWS AI (входит в МТС Web Services): для прикладных корпоративных моделей особенно важны любые качественные отраслевые данные. Поэтому расширение возможностей работы с данными потенциально способно ускорить разработку прикладных ИИ-продуктов, особенно в специализированных сценариях;
-
гендиректор Smart Engines Владимир Арлазаров: в практических задачах искусственного интеллекта ценность представляют не идентифицирующие человека сведения, а обезличенные массивы данных, отражающие поведенческий фактор, медицинскую статистику и другие закономерности. Но главное — речь идет об анонимизированных данных. Сегодня потребность в таких выборках во многих случаях закрывает синтез данных: метод, который позволяет создавать качественные, репрезентативные и неперсонифицированные наборы без нарушения прав граждан.
ссылка на оригинал статьи https://habr.com/ru/articles/1067286/