AI-сервисы передают рекламщикам заголовки и скриншоты ваших чатов
AI companies leak data to advertisers [pdf]
Исследование девяти популярных чат-ботов (ChatGPT, Gemini, Claude и других) показало: каждый из них встраивает сторонние трекеры, а шесть веб-клиентов и три Android-приложения передают рекламным и аналитическим сервисам заголовки, промпты и скриншоты диалогов — часто вместе с постоянными идентификаторами пользователя. Некоторые сервисы открывают публичные permalink-ссылки на беседы без контроля доступа, позволяя трекерам читать переписку целиком. Авторы также оценили соответствие этих практик GDPR и ePrivacy Directive и уведомили провайдеров и европейские регуляторы.
Интеграция традиционных трекинговых инфраструктур в разговорные AI-сервисы создаёт новые пути утечки конфиденциальной информации пользователей, включая артефакты диалогов и общедоступные беседы.
- delis-thumbs-7e
В одном старом эпизоде «Симпсонов» Лиза попадает в учительскую, где весь персонал потешается над детьми. Садовник Вилли изображает Милхауса: «О, я Милхаус, я рассказываю Вилли все свои секреты, потому что у меня нет друзей!» — и учителя смеются. Позже с Милхаусом случается что-то постыдное, и он тут же убегает с криком: «Я должен рассказать это Вилли!».
Теперь мы все стали Милхаусом.
- Coeur
«несколько провайдеров раскрывают третьим сторонам конфиденциальные артефакты, производные от бесед — включая заголовки, промпты и скриншоты — часто вместе с постоянными идентификаторами пользователя, позволяющими атрибутировать пользователя. Мы также обнаружили, что некоторые провайдеры публично выставляют постоянные ссылки на беседы без контроля доступа, что позволяет трекерам прочитать всю беседу».
Совсем не хорошо.
- drywater2
Нет, они не «утекают данные», данные продаются. Утечка данных требует ошибки. А это намеренно.
- pbasista
Не по теме:
Я недавно заметил, что, например, ChatGPT при использовании из веб-браузера периодически отправляет незавершённые промпты на свои серверы, а именно на эндпоинт `conversation/prepare`, не дожидаясь, пока пользователь действительно их отправит.
Эти частичные данные промпта потенциально могут использоваться для «предварительного прогрева» какого-то кэша.
Но их также можно использовать для отслеживания ритма письма пользователя, стиля исправления ошибок и эволюции его черновых идей по мере их формулирования в промпт. Я бы предположил, что такие данные тоже могут продаваться рекламщикам.
- kdaniel_03
Это тот же урок, что и в недавней истории с борьбой за авторство вклада в Навье-Стокса в начале этого месяца. У Бакмастера и Алпоге были неопубликованные черновики в приватных сессиях Codex, и OpenAI говорит, что никто их не видел, но признаёт, что деперсонализированные данные о продукте могли улучшить её модели. Там это обучающие данные, здесь — рекламные трекеры. В любом случае промпты и результаты, которые должны оставаться приватными, таковыми не остаются.
Вот почему, даже если открытые модели не идеальны, они должны победить. Можно пропустить приложение и запустить модель самому.
- segmondy
До этой новой эры ИИ ваши данные вычислялись, и то, что о вас выводилось, было «поверхностным», но сегодня... Тот профиль и то, что о вас можно узнать, пугает, особенно если вы постоянно взаимодействуете с облачным ИИ. ИМХО, риск номер один при использовании облачного ИИ — потеря приватности и потеря свободы. С ИИ и его возможностями на людей можно накладывать всё больше контроля, и чем больше вы себя выставляете, тем больше вы потеряете.
Например, у нас теперь есть самоуправляемые машины, у нас повсюду камеры. На основе вашего чата с облачным ИИ можно автоматически запустить событие автоматического наблюдения, которое следит за вами и отслеживает вас в реальном мире с помощью парка камер, машин, GPU, сигнала сотовой связи. Ваше отслеживание из-за ИИ перешло в реальный мир, и в конечном итоге самоуправляемая машина отвезёт вас на «обработку» против вашей воли — и не за то, что вы опубликовали на публичном форуме, а за ваши приватные подколки и болтовню с каким-то облачным ИИ.
Так что определённо добавляйте локальный ИИ в микс и держите личные вещи и мысли только локально.
- j4k0bfr
Это немного удивляет меня, учитывая, как сильно компании ИИ любят копить данные. Особенно потому, что некоторые из этих рекламных компаний — прямые конкуренты!
Моё лучшее предположение: эти рекламные механизмы немного поспешны и/или требования инвесторов к прибыльности борются с корыстными интересами компании.
Редактирование: полагаю, какие-то данные всегда придётся утекать, чтобы реклама в ИИ-чатах была максимально эффективной. Но я представляю, что компании ИИ предпочли бы сами показывать таргетированную рекламу, а не позволять конкурентам делать это за них. Было бы страшно увидеть, как компании ИИ сами становятся рекламными компаниями (а не просто размещают рекламу).
- 20k
Многие, похоже, очень отрицают тот факт, что OpenAI и компания плевать хотели на вас. Им плевать на соглашения, которые вы подписали. Для них вы просто куча денег.