AI-сервисы передают рекламщикам заголовки и скриншоты ваших чатов

AI companies leak data to advertisers [pdf]

Исследование девяти популярных чат-ботов (ChatGPT, Gemini, Claude и других) показало: каждый из них встраивает сторонние трекеры, а шесть веб-клиентов и три Android-приложения передают рекламным и аналитическим сервисам заголовки, промпты и скриншоты диалогов — часто вместе с постоянными идентификаторами пользователя. Некоторые сервисы открывают публичные permalink-ссылки на беседы без контроля доступа, позволяя трекерам читать переписку целиком. Авторы также оценили соответствие этих практик GDPR и ePrivacy Directive и уведомили провайдеров и европейские регуляторы.

Интеграция традиционных трекинговых инфраструктур в разговорные AI-сервисы создаёт новые пути утечки конфиденциальной информации пользователей, включая артефакты диалогов и общедоступные беседы.
  1. delis-thumbs-7e

    В одном старом эпизоде «Симпсонов» Лиза попадает в учительскую, где весь персонал потешается над детьми. Садовник Вилли изображает Милхауса: «О, я Милхаус, я рассказываю Вилли все свои секреты, потому что у меня нет друзей!» — и учителя смеются. Позже с Милхаусом случается что-то постыдное, и он тут же убегает с криком: «Я должен рассказать это Вилли!».

    Теперь мы все стали Милхаусом.

  2. Coeur

    «несколько провайдеров раскрывают третьим сторонам конфиденциальные артефакты, производные от бесед — включая заголовки, промпты и скриншоты — часто вместе с постоянными идентификаторами пользователя, позволяющими атрибутировать пользователя. Мы также обнаружили, что некоторые провайдеры публично выставляют постоянные ссылки на беседы без контроля доступа, что позволяет трекерам прочитать всю беседу».

    Совсем не хорошо.

  3. drywater2

    Нет, они не «утекают данные», данные продаются. Утечка данных требует ошибки. А это намеренно.

  4. pbasista

    Не по теме:

    Я недавно заметил, что, например, ChatGPT при использовании из веб-браузера периодически отправляет незавершённые промпты на свои серверы, а именно на эндпоинт `conversation/prepare`, не дожидаясь, пока пользователь действительно их отправит.

    Эти частичные данные промпта потенциально могут использоваться для «предварительного прогрева» какого-то кэша.

    Но их также можно использовать для отслеживания ритма письма пользователя, стиля исправления ошибок и эволюции его черновых идей по мере их формулирования в промпт. Я бы предположил, что такие данные тоже могут продаваться рекламщикам.

  5. kdaniel_03

    Это тот же урок, что и в недавней истории с борьбой за авторство вклада в Навье-Стокса в начале этого месяца. У Бакмастера и Алпоге были неопубликованные черновики в приватных сессиях Codex, и OpenAI говорит, что никто их не видел, но признаёт, что деперсонализированные данные о продукте могли улучшить её модели. Там это обучающие данные, здесь — рекламные трекеры. В любом случае промпты и результаты, которые должны оставаться приватными, таковыми не остаются.

    Вот почему, даже если открытые модели не идеальны, они должны победить. Можно пропустить приложение и запустить модель самому.

  6. segmondy

    До этой новой эры ИИ ваши данные вычислялись, и то, что о вас выводилось, было «поверхностным», но сегодня... Тот профиль и то, что о вас можно узнать, пугает, особенно если вы постоянно взаимодействуете с облачным ИИ. ИМХО, риск номер один при использовании облачного ИИ — потеря приватности и потеря свободы. С ИИ и его возможностями на людей можно накладывать всё больше контроля, и чем больше вы себя выставляете, тем больше вы потеряете.

    Например, у нас теперь есть самоуправляемые машины, у нас повсюду камеры. На основе вашего чата с облачным ИИ можно автоматически запустить событие автоматического наблюдения, которое следит за вами и отслеживает вас в реальном мире с помощью парка камер, машин, GPU, сигнала сотовой связи. Ваше отслеживание из-за ИИ перешло в реальный мир, и в конечном итоге самоуправляемая машина отвезёт вас на «обработку» против вашей воли — и не за то, что вы опубликовали на публичном форуме, а за ваши приватные подколки и болтовню с каким-то облачным ИИ.

    Так что определённо добавляйте локальный ИИ в микс и держите личные вещи и мысли только локально.

  7. j4k0bfr

    Это немного удивляет меня, учитывая, как сильно компании ИИ любят копить данные. Особенно потому, что некоторые из этих рекламных компаний — прямые конкуренты!

    Моё лучшее предположение: эти рекламные механизмы немного поспешны и/или требования инвесторов к прибыльности борются с корыстными интересами компании.

    Редактирование: полагаю, какие-то данные всегда придётся утекать, чтобы реклама в ИИ-чатах была максимально эффективной. Но я представляю, что компании ИИ предпочли бы сами показывать таргетированную рекламу, а не позволять конкурентам делать это за них. Было бы страшно увидеть, как компании ИИ сами становятся рекламными компаниями (а не просто размещают рекламу).

  8. 20k

    Многие, похоже, очень отрицают тот факт, что OpenAI и компания плевать хотели на вас. Им плевать на соглашения, которые вы подписали. Для них вы просто куча денег.

Ещё за этот день

2026-09-29