OpenAI сообщила 25 сентября, что её собственные ИИ-агенты выкладывали в интернет изображения пользователей ChatGPT. По данным компании, «на сегодняшний день выявлено 53 случая, когда предоставленные пользователями изображения были размещены на хостингах изображений в виде ссылок, не значившихся в публичных списках». OpenAI утверждает, что вместе с провайдерами хостинга удалила большинство из них, однако часть снимков всё ещё доступна в сети. Расследование продолжается.
OpenAI не может назвать, чьи именно изображения пострадали (символическое изображение)
Находка стала результатом проведённого OpenAI разбора июльского инцидента с Hugging Face. С тех пор компания месяц за месяцем проверяет, что делали её агенты за пределами своих сред во время обучения и тестирования. Выяснилось, что до внедрения новых мер защиты агенты отправляли обучающие и оценочные данные сторонним сервисам. OpenAI называет это «неприемлемым использованием этих данных». Большая часть затронутых данных не принадлежала пользователям, но часть обучающего массива формируется из диалогов, разрешённых для обучения, — именно оттуда и взялись 53 изображения. Компания также раскрыла отдельный случай, когда один из агентов обошёл «песочницу» через DNS.
Прежде чем пользовательский контент попадает в обучение, OpenAI отделяет его от данных аккаунта и прогоняет через «версию фильтра приватности OpenAI, чтобы удалить персональные сведения — имена, контактные данные и номера счетов». По той же причине компания сейчас не может ни с кем связаться: «Наш технический подход и политика конфиденциальности не позволяют нам заново сопоставить эти данные с исходным аккаунтом пользователя». При этом OpenAI не уточняет, что фильтр делает с лицами, удостоверениями личности или автомобильными номерами на фото. Проверить, попало ли одно из ваших изображений в число 53, невозможно.
Контент, который никогда не был разрешён для обучения, в выборку не попал. Это касается аккаунтов с отключённой опцией «Improve the model for everyone» и временных чатов. Рабочие пространства ChatGPT Business, Enterprise и Edu, а также API исключены, если только администратор не включил обучение вручную. На личных тарифах Free, Plus и Pro эта настройка включена по умолчанию.
В веб-версии откройте «Настройки» через изображение профиля, перейдите в раздел Data controls и отключите «Improve the model for everyone». В мобильном приложении та же страница управления данными находится в боковом меню под изображением профиля. Настройка распространяется только на новые диалоги: по данным справки OpenAI, когда она выключена, «ваши новые беседы не будут использоваться для обучения моделей OpenAI», а всё, что уже использовалось, там и останется. Новый центр приватности ChatGPT этого не меняет, поскольку лишь ведёт к тем же настройкам.
Одно исключение OpenAI называет сама: «Если вы решите оставить отзыв, вся связанная с ним беседа может быть использована для обучения наших моделей» — даже при выключенной настройке. Для фотографий удостоверений, детей или документов безопаснее использовать временный чат и не оценивать такие диалоги.












