Рекомендации PDPC охватывают разные этапы жизненного цикла GenAI: сбор информации из открытых источников, данные, которые пользователь передал для получения обычной услуги, а затем использованные для обучения или улучшения модели, развертывание систем, безопасность, хранение, а также запросы на доступ к данным и их исправление.
Главная проблема — смена первоначальной цели обработки. Человек мог передать сведения для покупки, ведения аккаунта, обращения в поддержку или другой конкретной услуги. Позднее эти данные могут быть повторно использованы в больших масштабах для обучения или дообучения модели. Из-за этого пользователю сложнее понять, что произошло с его информацией, контролировать ее дальнейшее использование и реализовать свои права после включения данных в большой обучающий массив.
PDPC также разделяет ответственность между участниками цепочки поставок ИИ:
Если организация хочет использовать пользовательские данные для разработки GenAI-модели, а применимое исключение из требования о согласии по Закону Сингапура о защите персональных данных (PDPA) отсутствует, она должна получить согласие через специальное уведомление об ИИ. В нем необходимо прямо сказать, что данные будут использованы для разработки или улучшения генеративной ИИ-модели.
Общие формулировки вроде «улучшение продукта», «развитие новых услуг», «персонализация» или «повышение качества сервиса» обычно не дают пользователю достаточно ясного понимания, что его данные пойдут на обучение или дообучение GenAI-модели.
Особенно важен сценарий, когда сведения изначально передали через уже существующий продукт или сервис для цели, не связанной с генеративным ИИ, а затем решили использовать для разработки модели. Организации нужно оценить контекст первоначального сбора, новую цель обработки и наличие исключения из требования о согласии.
Исключение PDPA для общедоступных данных может позволять собирать опубликованные персональные данные без согласия для разработки модели. Однако сам факт доступности информации в интернете еще не означает, что она автоматически подпадает под это исключение.
Данные за платным доступом, авторизацией, регистрацией или иным цифровым барьером требуют отдельной оценки: действительно ли они остаются общедоступными для такой цели.
Должным образом анонимизированные данные не считаются персональными данными для целей PDPA, поскольку по ним нельзя установить личность человека. Материалы PDPC также рекомендуют по возможности использовать анонимизированные данные для аналитики и исследований.
При этом удалить только имя недостаточно. Если человека можно идентифицировать по оставшимся сведениям или с помощью другой разумно доступной информации, набор данных может не считаться анонимным. Поэтому организациям необходимо проверять, действительно ли выбранный процесс анонимизации устраняет возможность идентификации.
Предоставленные источники не устанавливают отдельного универсального исключения именно для записей разговоров в кол-центре. Если запись позволяет прямо или разумно установить личность звонящего, ее следует рассматривать как персональные данные при оценке возможности повторного использования в GenAI.
До применения такой записи для разработки модели организации потребуется соответствующее основание по PDPA — например, действующее согласие, уведомление или другое предусмотренное законом исключение. Конкретный вывод зависит от содержания записи, обстоятельств ее получения, предполагаемого использования и применимых норм. Дополнительных специальных правил для записей кол-центра предоставленные материалы не подтверждают.
Уведомление должно содержать конкретную и понятную информацию. Как минимум следует указать:
Обычная политика конфиденциальности по-прежнему может содержать полезные общие сведения. Но если в ней цель обучения генеративного ИИ остается неясной, одной такой политики недостаточно. Практический критерий прост: разумный пользователь должен понять, что его персональные данные могут быть использованы для разработки или улучшения генеративной ИИ-модели.
Предоставленные материалы не требуют единого обязательного формата или конкретного места размещения для всех организаций. Практичный вариант — показывать информацию там, где собираются соответствующие данные или используется сервис: при регистрации, в своевременном уведомлении внутри продукта, в настройках конфиденциальности аккаунта или через заметную ссылку на специальное уведомление о конфиденциальности.
Это рекомендация по реализации, а не исчерпывающий перечень мест из информационного материала PDPC. В любом случае уведомление должно быть заметным и конкретным, а не спрятанным в длинных общих условиях.
Пользователь может запросить доступ к своим персональным данным или их исправление даже после того, как сведения были использованы при разработке GenAI. Организациям следует выстраивать разумные процессы на этапе сбора данных, рассматривать такие запросы индивидуально и применять подходящие технические меры, хотя отслеживание конкретной информации внутри большой обучающей выборки может быть сложным.
Если обработка основана на согласии, человеку должны объяснить, как отказаться от него или отозвать его. Однако это не означает автоматического права продолжать пользоваться всеми функциями сервиса на прежних условиях. Возможность сохранить доступ к основной услуге зависит от роли обучения GenAI, необходимости такой обработки и того, как организация построила механизм согласия. Предоставленные источники не устанавливают универсального права на сохранение полного доступа после любого отказа.
Рекомендации IMDA посвящены потребительской стороне GenAI и распространяются на внешние чат-боты, которые напрямую взаимодействуют с клиентами, потребителями или широкой публикой. Они должны помочь людям принимать более информированные решения, унифицировать раскрытие информации и сделать поставщиков более ответственными за заявленные практики безопасности и надежности.
«Карточка чат-бота» сравнивается с этикеткой на продукте питания или лекарстве: пользователь получает единое, доступное место, где можно быстро проверить важные характеристики сервиса. Это может быть отдельная информационная страница или документ с раскрытием информации.
Карточка должна соответствовать трем принципам:
Полезная карточка должна описывать:
Карточка не является гарантией точности или безопасности чат-бота. Ее задача — дать человеку более понятную основу для решения, когда можно полагаться на инструмент, какую информацию ему сообщать и куда обращаться, если возникла проблема.
Поначалу IMDA сосредоточилось на публичных чат-ботах из-за их широкого охвата и связанных с ними рисков для конфиденциальности, безопасности детей и людей, уязвимых с психологической точки зрения. В дальнейшем этот подход может стать ориентиром и для других GenAI-приложений, а также для отраслевых рекомендаций.
Google, Meta, DBS, OCBC, Singapore Airlines и Synapxe заявили, что будут использовать добровольные рекомендации как ориентир при улучшении прозрачности своих публичных чат-ботов. Это означает намерение выстраивать практики и совершенствовать их, но не доказывает, что каждая из организаций уже запустила одинаковую информационную карточку.
Для банков особое значение будут иметь объяснение функций клиентских чат-ботов, их ограничений и мер защиты, а также согласование раскрытия информации с действующими процессами управления ИИ и рисками. DBS сослался на свои клиентские ИИ-инициативы, а OCBC связал рекомендации с уже существующими системами управления ИИ и рисками.
Singapore Airlines заявила, что продолжит пересматривать и укреплять управление ИИ и защитные меры по мере расширения клиентских сервисов с использованием ИИ. Google и Meta поддержали идею более ясной и доступной информации о работе их ИИ-продуктов и взаимодействии пользователей с ними.
Государственные учреждения также планируют учитывать этот подход: Национальный совет библиотек Сингапура и Совет по укреплению здоровья намерены использовать рекомендации как ориентир для собственных публичных чат-ботов.
Сингапур объединил более конкретное раскрытие информации о некоторых видах использования персональных данных с добровольным стандартом прозрачности для публичных чат-ботов. Эти меры дополняют друг друга, но не заменяют одна другую.
Организациям стоит:
В итоге речь не идет о безусловной возможности пользователя остановить любое использование данных, связанное с ИИ. Смысл новых мер — сделать повторное использование информации более заметным, управление данными более осознанным, а публичные ИИ-сервисы — более подотчетными.