OpenAI выявила утечку изображений пользователей ChatGPT
OpenAI сообщила о размещении 53 пользовательских изображений ChatGPT на сторонних сервисах из-за особенностей работы ИИ-агентов. Компания продолжает расследование и рекомендует меры для защиты данных.
Crius
Обнаружение инцидента
25 сентября OpenAI сообщила о выявлении 53 случаев, когда изображения, предоставленные пользователями ChatGPT, были размещены на сторонних сайтах для хранения изображений в виде ссылок, которые не были доступны публично. Компания взаимодействовала с хостинг-провайдерами для удаления большинства этих изображений, однако часть файлов по-прежнему остается в сети. Расследование продолжается.
Причины утечки изображений
Факт размещения изображений был установлен в ходе проверки инцидента, связанного с Hugging Face, в июле. С тех пор проводится анализ действий ИИ-агентов OpenAI вне их изолированных сред во время обучения и тестирования, с разбором данных по месяцам. Было установлено, что до внедрения новых мер безопасности агенты отправляли данные для обучения и оценки на сторонние сервисы. Большинство затронутых данных не поступало непосредственно от пользователей, однако часть обучающих данных действительно формируется из разговоров, разрешённых для обучения, и именно из них были получены эти 53 изображения. Также был зафиксирован отдельный случай, когда агент использовал DNS для обхода ограничений своей песочницы.
Причины отсутствия уведомлений пользователей
Перед использованием пользовательского контента для обучения OpenAI отделяет его от информации об аккаунте и применяет фильтр OpenAI Privacy Filter для удаления личных данных, таких как имена, контактная информация и номера счетов. В результате компания не может связать изображения с конкретными пользователями и не имеет технической возможности уведомить их. Не уточняется, как фильтр обрабатывает лица, удостоверения личности или номерные знаки на фотографиях. Проверить, было ли конкретное изображение среди затронутых, невозможно.
Контент, который никогда не был допущен к обучению, не включается в обучающие выборки. Это касается аккаунтов с отключённой функцией «Улучшать модель для всех», временных чатов, а также сервисов ChatGPT Business, Enterprise, Edu и API, если только администратор не активировал соответствующую настройку. В личных аккаунтах Free, Plus и Pro эта функция включена по умолчанию.
Как отключить использование изображений для обучения
Для отключения использования новых разговоров в обучении моделей OpenAI необходимо в веб-версии открыть настройки через изображение профиля, перейти в раздел управления данными и деактивировать опцию «Улучшать модель для всех». В мобильном приложении эта настройка находится в боковом меню под профилем пользователя. Изменения распространяются только на новые разговоры; ранее использованные для обучения данные останутся в системе. Новый центр конфиденциальности ChatGPT не изменяет этот порядок, так как ссылается на те же настройки.
Исключения и рекомендации по безопасности
OpenAI отмечает, что если пользователь оставляет отзыв, весь связанный с ним разговор может быть использован для обучения моделей, даже при отключённой настройке. Для фотографий удостоверений личности, детей или документов рекомендуется использовать временный чат и не оценивать такие разговоры, чтобы повысить безопасность данных.
