21 июля 2026 г. · Digiday
Reddit и данные для ИИ: конфликт с рекламным бизнесом
Вадим Барсов · Growth / Marketing / Adtech / LLM / ML · barsov-growth.ru
Источник: Digiday
Контекст
Последние два года Reddit строил разговор с рекламодателями вокруг одной идеи: его данные уникальны. Не пассивные клики и не поведенческие сигналы, а живые разговоры людей в сообществах — то, что компания называет «контекстным намерением». На этой предпосылке выросли два продукта: Reddit Max (автоматизированная закупка и таргетинг) и Reddit Community Intelligence (аналитический слой для рекламодателей). Оба обещают одно — Reddit понимает, о чём люди реально говорят, лучше любой другой платформы.
Проблема в том, что тот же самый массив постов и комментариев Reddit продаёт по лицензионным сделкам, чтобы OpenAI и Google могли обучать на нём свои модели. И теперь компания вслух задаётся вопросом: не подрывают ли эти сделки её же рекламную историю про эксклюзивность?
Что произошло
Digiday зафиксировал редкое для платформы признание. Весь маркетинговый нарратив Reddit держится на том, что данные принадлежат только ей и не похожи на чьи-либо ещё. Но лицензирование этих данных внешним ИИ-компаниям формально размывает эту эксклюзивность: контент, на котором строится «уникальный» рекламный таргетинг, становится топливом для чужих генеративных моделей.
Любопытный нюанс — так называемый «эффект ореола». Рекламодатели всё чаще тратят на Reddit не только ради прямого таргетинга, но и потому, что верят: аутентичное присутствие в сообществах повышает шансы бренда быть процитированным в ответах, которые генерирует ИИ. То есть сам факт того, что модели обучаются на Reddit, стал аргументом в пользу рекламы на Reddit. Данные одновременно и продаются наружу, и работают как маркетинговый актив внутри.
Клэр Холубовски из Enders Analysis отмечает, что бизнес Reddit в целом менее уязвим к дезинтермедиации со стороны ИИ, чем платформы, построенные вокруг таргетинга по идентичности. Логика простая: если ценность в контекстных разговорах, а не в профиле пользователя, то её сложнее «отобрать» одним ИИ-ассистентом, вставшим между брендом и аудиторией.
Почему это важно
Здесь пересекаются две модели монетизации одного и того же датасета, и они начинают конкурировать друг с другом.
Первая модель — реклама. Она требует, чтобы данные оставались дефицитом. Дефицит = премия. Как только уникальный сигнал становится доступен всем через обученные модели, аргумент «только у нас так понимают намерение» слабеет.
Вторая модель — лицензирование данных для ИИ. Это быстрый, высокомаржинальный денежный поток, который инвесторы любят: прямые сделки с OpenAI и Google выглядят как чистая выручка почти без затрат. Но каждая такая сделка немного удешевляет первый актив.
Это классическая дилемма owner-of-data платформы: продать доступ дорого один раз или капитализировать эксклюзивность годами через рекламу. Reddit пытается делать и то и другое, и вопрос, который он теперь задаёт публично, — где точка, после которой одно начинает есть другое.
Для индустрии adtech это показательный кейс. Мы привыкли, что «данные — новая нефть», но нефть нельзя продать и сжечь одновременно. Генеративный ИИ превращает контент в обучающий материал, и любая платформа, живущая на первичных данных, теперь считает не только рекламную выручку, но и альтернативную стоимость лицензирования — и наоборот.
Как это читать из РФ
Для специалиста в РФ здесь несколько практических слоёв.
Первое — сам конфликт моделей монетизации данных. У любого сервиса с большим объёмом пользовательского контента (маркетплейсы, отзовики, форумы, соцсети, банковские экосистемы) сейчас появляется тот же выбор: продавать данные для обучения моделей или беречь как основу собственных рекламных и рекомендательных продуктов. В РФ крупные экосистемы уже строят внутренние LLM, и вопрос эксклюзивности данных стоит остро — только чаще он решается внутри холдинга, без внешних лицензионных сделок. Это, к слову, снижает описанный конфликт: данные не утекают конкуренту, а обогащают собственный ИИ-стек.
Второе — «эффект ореола» и цитируемость в ИИ-ответах. Идея, что бренд стоит присутствовать там, где обучаются модели, ради упоминаний в генеративных ответах, — это ранняя форма GEO (generative engine optimization). В РФ поисковые и ассистентские сервисы всё активнее отдают сгенерированные ответы, и присутствие в источниках, на которых они обучаются и которые цитируют, становится реальным каналом. Стоит уже сейчас смотреть, откуда локальные ассистенты берут ответы по вашей категории, и попадает ли туда ваш контент.
Третье — контекстное намерение против таргетинга по идентичности. Мысль Холубовски о меньшей уязвимости контекстных данных к дезинтермедиации ИИ важна и для нас. По мере ужесточения регулирования персональных данных и деградации сторонних идентификаторов ставка на контекст (о чём говорят, что обсуждают) выглядит устойчивее, чем ставка на профиль конкретного человека. Для продуктовой аналитики это сигнал: инвестируйте в понимание тем и намерений, а не только в атрибуцию по идентичности.
Четвёртое — риск обесценивания собственного актива. Если вы владелец данных и рассматриваете сделку по их предоставлению для обучения моделей, оцените не только прямую выручку, но и то, насколько вы удешевляете свой рекламный/рекомендательный продукт. Иногда одноразовая сделка выглядит выгодно в квартале и вредит юниту на горизонте лет.
Что взять в работу
- Если вы платформа с UGC — пропишите политику: какие данные монетизируются наружу, а какие остаются эксклюзивным топливом для собственных продуктов. Не смешивайте бездумно.
- Заведите отдельную метрику «цитируемость в генеративных ответах» по вашей категории — это уже канал, а не футурология.
- Сдвигайте таргетинг-логику от идентичности к контексту и намерению: это устойчивее к деградации идентификаторов и к дезинтермедиации ИИ.
- Перед любой сделкой по лицензированию данных считайте альтернативную стоимость: сколько рекламной/продуктовой премии вы теряете, обесценивая эксклюзивность.
- Для брендов: аутентичное присутствие в тематических сообществах теперь работает дважды — как обычный охват и как вклад в то, что о вас «знают» модели.
Reddit публично признал то, о чём многие платформы предпочитают молчать: данные нельзя одновременно продать и сохранить их дефицит. Кто первым научится балансировать эти две модели, тот и построит устойчивую экономику ИИ вокруг собственного контента.
Читайте также
Смежные материалы на сайте:
- ИИ в рекламе: гонка за пользой, а не за качеством — Рекламные агентства внедряют ИИ ради экономии на сотрудниках, а не ради повышения качества. Разбираем, почему …
- Pix против Трампа: госплатёжка как инфраструктура данных — Бразильская система мгновенных платежей Pix стала мишенью политического давления США. Разбираем, почему это ис…
- GPT-5.6: экономика интеллекта и агенты с длинным горизонтом — Разбор GPT-5.6: рекорды на Agents' Last Exam, цена за токен и что это значит для агентных рабочих процессов и …
Источник
https://digiday.com/marketing/reddit-questions-if-ai-data-deals-could-hurt-its-ad-business