Эссе

Сначала чистые данные: выявление фрода как ремесло

Рекламный фрод обычно считают проблемой безопасности, но на практике это постоянная гигиена данных: следующие модели наследуют любое пропущенное загрязнение.

Сегодня утром где-то на маркетинговой панели один показатель ведёт себя именно так, как все надеялись. Кликабельность растёт. Стоимость привлечения клиента снижается. Кто-то делает снимок экрана для встречи в понедельник, и все в комнате согласно кивают, поскольку хороший результат легко принять на веру и трудно подвергнуть сомнению, но почти никто не спросит, какая доля исходного трафика вообще появилась благодаря человеку, который осознанно сделал выбор. Сама панель не даёт повода задавать такой вопрос.

Именно этот вопрос лежит в основе идеи, которая набирает силу среди наиболее вдумчивых специалистов по рекламе и аналитике: борьба с рекламным фродом по своей сути не относится к функциям безопасности. Внешне всё выглядит именно так, ведь поставщики продают защиту, а расходы на неё стоят рядом с расходами на межсетевые экраны, однако настоящая работа больше напоминает работу санитарного инспектора или лабораторный протокол предотвращения загрязнений. Задача заключается не в том, чтобы поймать нарушителя. Нужно поддерживать чистоту потока данных на уровне, достаточном для надёжности всего, что строится поверх него. Иначе модели атрибуции, похожие аудитории, контрольные показатели эффективности и вся архитектура представлений о том, «что работает», незаметно возводятся на песке.

Словарь, соответствующий сложности задачи

Совет по медиарейтингам, американская организация по аккредитации поставщиков систем измерения рекламы, закрепил здесь не одну, а две разные категории. Общий недействительный трафик система выявляет в реальном времени и обычно без особых споров, используя «стандартные методы фильтрации на основе списков или других стандартизированных проверок параметров»: известные диапазоны IP-адресов центров обработки данных, заявленные боты и браузеры, поведение которых не похоже на работу браузера. Сложный недействительный трафик включает всё, что пропускают обычные фильтры. Это активность, которая «состоит из более трудных для обнаружения ситуаций, требующих расширенной аналитики, подтверждения или координации по нескольким точкам, значительного участия человека и других мер для анализа и выявления». Получить аккредитацию MRC для обнаружения сложной категории труднее, чем для общей, и это оправданно. Взломанное домашнее устройство, которое просматривает обычные страницы, совсем не похоже на ферму ботов. Чтобы его обнаружить, нужно сопоставлять закономерности между аккаунтами и разными периодами времени, а такую возможность не обеспечивает ни один отдельный список блокировки.

Как выглядит разница в 91 раз

В 21-м выпуске отчёта о качестве медиа компания Integral Ad Science оценила мировую долю недействительного трафика в обнадёживающие 1,1% и при этом назвала показатель стабильным. Отчёт вышел в июле 2026 года и основывался на измерениях за 2025 год. Если прочитать только главную цифру, фрод покажется погрешностью округления. Однако разбивка по рынкам и каналам меняет картину. В Северной Америке, крупнейшем рекламном рынке мира, показатель превысил среднее мировое значение. В подключённом телевидении результаты чётко разделились на два разных мира в зависимости от того, включил ли покупатель защиту.

Сегмент (отчёт IAS о качестве медиа, 21-й выпуск, данные за 2025 год) Доля недействительного трафика
Среднее мировое значение, все каналы 1,1%
Северная Америка (регион с самой высокой долей недействительного трафика) 1,36%
США (самый высокий показатель среди отдельных рынков) 1,40%
Подключённое телевидение, кампании без защиты от фрода 9,1%
Подключённое телевидение, кампании с защитой от фрода 0,1%

Последняя пара показателей в миниатюре передаёт весь аргумент. Разница между 9,1% и 0,1% недействительного трафика возникла не из-за доступности технологии. Сегодня каждый серьёзный покупатель рекламы в подключённом телевидении может обратиться примерно к одним и тем же поставщикам средств обнаружения. Разница появляется из-за того, была ли защита включена, правильно настроена и оставлена активной в каждой позиции кампании, а не только в очевидных местах. Различие в 91 раз не указывает на сложную задачу, которую плохо решили. Оно указывает на простую задачу, которой занимались непоследовательно, и именно поэтому по определению похоже на нарушение гигиены, а не на брешь в безопасности.

Набор данных, загрязнённый трафиком ботов, не просто занижает эффективность на величину загрязнения. Он учит каждую построенную поверх него модель, включая атрибуцию, похожие аудитории и тестирование креативов, предпочитать то, что предпочитали боты. Всё происходит незаметно, поскольку обычная панель не отмечает разницу между настоящим кликом и его имитацией.

Налог, который не уменьшается

Juniper Research уже несколько лет отслеживает денежную стоимость этого загрязнения, и динамика не позволяет считать, что отрасль побеждает фрод. В 2022 году компания оценила мировые потери в 68 миллиардов долларов против 59 миллиардов годом ранее. В следующем крупном прогнозе, опубликованном в октябре 2023 года, оценка выросла ещё сильнее. Согласно прогнозу, в 2023 году рекламный фрод должен был обойтись маркетологам в 84 миллиарда долларов, что составляло около 22% от 382 миллиардов долларов расходов на интернет-рекламу. В том же отчёте предполагалось, что к 2028 году ежегодные расходы маркетологов на цифровую рекламу достигнут 747 миллиардов долларов, при этом на фрод по-прежнему придётся 23%, почти такая же доля, как в 2023 году, или примерно 172 миллиарда долларов. Ожидается, что потери ещё сильнее сосредоточатся в Северной Америке, на которую, по прогнозу компании, придётся 42% общего объёма в 2028 году. Это отражает размер и развитость рынка, а не какую-либо его особую уязвимость.

Эти расчёты не включают вторую, связанную форму загрязнения, которая вообще не является фродом в классическом смысле. Речь идёт о технически человеческом трафике, поступающем через рекламный инвентарь, созданный для программной закупки, а не для чтения. В декабре 2023 года Ассоциация национальных рекламодателей опубликовала исследование, которое проследило, как 123 миллиона долларов реальных рекламных расходов распределились между 35,5 миллиарда показов. Оно установило, что сайты, созданные ради рекламы, строят страницы вокруг кликбейта и чрезмерно крупных рекламных блоков, а не вокруг контента, который кто-то хотел найти. На такие сайты пришёлся 21% проверенных показов и 15% проверенных расходов. Категория росла быстро: примерно с 5% веб-аукционов в начале 2020 года почти до 30% всех веб-аукционов к середине 2023 года. Сопоставив результаты со всем более широким рынком программной рекламы в открытом интернете, ANA обнаружила, что 22 миллиарда долларов из потраченных 88 миллиардов были растрачены впустую или непродуктивно. Ассоциация проследила путь денег достаточно подробно и сообщила, что до потребителя вообще доходит лишь $0,36 из каждого доллара, поступающего на платформу закупки рекламы.

Почему это гигиена, а не безопасность

Если мыслить в терминах безопасности, у работы есть конечная точка: закрыть уязвимость, заблокировать злоумышленника и двигаться дальше. Гигиена вообще не предполагает конечной точки. Кухню нельзя убрать один раз навсегда. Лаборатория не стерилизует инструменты лишь однажды. Как оказывается, рекламный аккаунт или аналитический конвейер тоже требуют постоянной работы. Ремесло заключается не столько в покупке инструмента обнаружения, сколько в неприметной дисциплине его применения всегда и везде. Чистый исходный уровень нужно считать условием каждого последующего решения, а не пунктом нерегулярной проверки. Поддерживать такую привычку труднее, чем кажется, поскольку загрязнённые данные редко заявляют о себе. Система просто начинает оптимизировать работу в пользу источника загрязнения. Когда показатели наконец заметно расходятся с ожиданиями, построенная поверх них модель часто уже успевает многократно усвоить неверный урок.

Специалистов, которые относятся к этому серьёзно, обычно объединяет одна черта: они проверяют данные до оптимизации, а не после неё. Для них качество трафика становится контрольным условием, которое кампания должна выполнить, прежде чем её показатели смогут повлиять на следующее решение. Это не разбор задним числом, который проводят раз в квартал, когда результаты начинают казаться странными. В конечном счёте речь идёт о небольшой дисциплине с несоразмерно большим эффектом. Причина проста: слишком многое из того, что современная система маркетинга или аналитики думает о себе, опирается на данные, которые никто не догадался сначала очистить.

Обновлено 24 августа 2026.