ChatGPT начал узнавать, что вы делаете на других сайтах
Разбор, который разошёлся за сутки: у OpenAI появился рекламный сборщик, и он связывает ваш аккаунт в ChatGPT с тем, что вы смотрите на посторонних сайтах. Механика знакома по Meta и Google, но здесь идентификатор привязан к аккаунту, в котором вы ведёте личные разговоры.
Как это устроено
На стороне чата браузеру ставится кука с идентификатором, привязанным к вашей учётной записи. Настройки куки позволяют отправлять её при запросах с чужих сайтов, живёт она год.
Дальше вступает вторая часть. Компания, покупающая рекламу в ChatGPT, ставит у себя небольшой фрагмент кода от OpenAI — тот самый рекламный пиксель. Когда вы заходите на такой сайт, код загружается, и вместе с запросом уходит ваш идентификатор, а с ним сведения о странице: какие товары вы ищете, что читаете, что покупаете.
Автор разбора подчёркивает техническую деталь. В коде пикселя есть путь, который не передаёт учётные данные, но это не помогает: браузер прикрепляет куку уже к запросу за самим скриптом, до того как код OpenAI начнёт работать. Достаточно загрузки тега.
Масштаб и вторая находка
По наблюдениям автора речь идёт о 936 рекламных пикселях на 1029 хостах, проверенных двумя независимыми способами захвата трафика.
Вторая находка интереснее первой. Тот же скрипт собирает со страницы рекламодателя ещё и идентифицирующие данные, причём сам различает источники: то, что рекламодатель передал намеренно, и то, что скрипт вытащил из полей формы, текста страницы и служебной шины менеджера тегов. В наблюдаемом трафике собранного скриптом оказалось втрое больше, чем переданного сознательно: 685 событий против 255.
Почему это важнее обычной рекламной слежки
Трекинг в интернете существует давно, и сам по себе пиксель новостью не назовёшь. Разница в том, с чем связывается собранный профиль.
Поисковый запрос человек формулирует коротко и обезличенно. В чате он рассказывает про здоровье, долги, отношения, рабочие конфликты и планы. Связка «этот аккаунт смотрел такие-то товары» ложится поверх этого контекста, а не рядом с ним.
Добавьте к этому, что кука живёт год, и понятно, почему разбор вызвал такую реакцию.
Что можно сделать
Полных гарантий нет, но снизить сбор реально.
- Заходить в чат в отдельном профиле браузера. Куки не пересекаются с обычным сёрфингом.
- Блокировать трекеры. Любой приличный блокировщик режет сторонние рекламные скрипты, включая этот.
- Проверять настройки приватности в аккаунте. Там обычно есть тумблеры про персонализацию рекламы и использование данных.
- Держать чувствительные темы отдельно. Разговор о здоровье или финансах удобно вести в сервисе, который не строит рекламный профиль.
Последний пункт касается и нас: мы не продаём рекламу и не ставим пикселей на чужие сайты, так что связывать ваш аккаунт с посторонним сёрфингом нам нечем. Удалить историю и файлы можно в профиле, в разделе удаления данных.
Что именно собирает рекламный сборщик?+
Идентификатор, привязанный к вашему аккаунту в чате, плюс сведения о странице на сайте рекламодателя: искомые товары, читаемые статьи, покупательское поведение.
Как идентификатор попадает на чужие сайты?+
Через куку с разрешением на межсайтовую отправку. Она уходит вместе с запросом за рекламным скриптом OpenAI, который рекламодатель поставил у себя.
Помогает ли режим инкогнито?+
Частично: в приватном окне куки не сохраняются между сессиями. Но в пределах одной сессии связка всё равно работает, если вы в этом же окне заходили в чат.
Сколько живёт такая кука?+
По данным разбора — год, с настройками, позволяющими отправлять её на сторонние домены.
Как ограничить сбор?+
Отдельный профиль браузера для чата, блокировщик сторонних скриптов, проверка настроек рекламы в аккаунте. Чувствительные темы лучше обсуждать в сервисе без рекламной модели.
Что дальше почитать
- Удаление данных и аккаунта — что хранится в переписке и как это убрать.
- Букмекер нацеливает рекламу на проигрывающих — к чему приводит оптимизация под чужую метрику.