Изображения пользователей ChatGPT, опубликованные в Интернете представителями OpenAI: как отказаться от участия

25 сентября компания OpenAI сообщила, что её собственные ИИ-агенты разместили в Интернете изображения, предоставленные пользователями ChatGPT. По данным компании, «на сегодняшний день мы выявили 53 случая, когда предоставленные пользователями изображения были размещены на сайтах хостинга изображений в виде ссылок, которые не были доступны для общего просмотра». OpenAI сообщает, что совместно с хостинг-провайдерами удалось удалить большинство из них, однако некоторые изображения по-прежнему доступны в сети. Расследование продолжается.
Как изображения пользователей попали к агентам
Этот вывод был сделан в ходе анализа OpenAI инцидента с Hugging Face, произошедшего в июле. С тех пор компания проверила действия своих агентов за пределами их рабочих сред во время обучения и тестирования, анализируя данные месяц за месяцем. Было установлено, что до введения новых мер безопасности агенты отправляли данные для обучения и оценки на сторонние сервисы. OpenAI называет это «ненадлежащим использованием данных». Большая часть затронутых данных не происходила от пользователей. Однако часть обучающих данных OpenAI происходит из диалогов, пригодных для обучения, и именно оттуда были получены эти 53 изображения. OpenAI также сообщила об отдельном инциденте, в ходе которого агент использовал DNS для обхода своей песочницы.
Почему вам никто не сообщит об этом
Прежде чем пользовательский контент попадает в процесс обучения, OpenAI отделяет его от информации об учетной записи и запускает «версию фильтра конфиденциальности OpenAI для удаления личных данных, таких как имена, контактная информация и номера счетов». Именно по этой причине компания не может сейчас связаться ни с кем. По словам компании: «Наш технический подход и политика конфиденциальности не позволяют нам вновь соотнести эти данные с исходной учетной записью пользователя». OpenAI не уточняет, как фильтр обрабатывает лица, удостоверения личности или номерные знаки на фотографиях. У вас нет возможности проверить, было ли одно из ваших изображений среди тех 53.
Контент, который изначально не подходил для обучения, не был включён. Это касается учётных записей, в которых отключена функция «Улучшить модель для всех», а также временных чатов. Рабочие пространства ChatGPT Business, Enterprise и Edu, а также API исключены из обучения, если только администратор не включил эту функцию. На личных учётных записях Free, Plus и Pro эта настройка включена по умолчанию.
Как не допустить использования ваших изображений для обучения
В веб-версии откройте «Настройки» через свою аватарку, перейдите в раздел «Управление данными» и отключите функцию «Улучшать модель для всех». В мобильном приложении та же страница «Управление данными» находится под боковой панелью и вашей аватаркой. Этот параметр действует только в отношении новых бесед. На странице справки OpenAI указано, что при отключенной функции «ваши новые беседы не будут использоваться для обучения моделей OpenAI», поэтому все данные, уже использованные для обучения, останутся в системе. Новый центр конфиденциальности ChatGPT не меняет этого, поскольку он лишь содержит ссылку на настройки, как показал Notebookcheck на прошлой неделе.
OpenAI сама указывает на одно исключение. «Если вы решите оставить отзыв, весь диалог, связанный с этим отзывом, может быть использован для обучения наших моделей», даже при отключенной настройке. В случае фотографий удостоверений личности, детей или документов более безопасным выбором будет использование временного чата, и лучше не ставить оценки таким чатам.





