Клиент заказал CTV-кампанию на город с населением 300 тыс. человек. Отчет верификатора разошелся с логами площадки на треть — при ожидаемых 5%. Это не всегда ошибка одной из сторон. Чаще всего площадка и верификатор по-разному определяют географию пользователя. Sostav вместе с Андреем Григорьевым (CEO
getads ) и Артемом Каневым (руководитель отдела интеграции getads), а также экспертами Weborama, AdRiver, Admon.ai и Adserving проанализировал, как работает IP-геолокация в CTV и что делать с расхождениями.
Почему в CTV гео определяют по IP
В Smart TV почти нет GPS-координат и браузерных сигналов, поэтому основной метод — IP-адрес. Но он указывает не на пользователя, а на размещение серверов провайдера. Операторы CTV используют независимые геобазы (MaxMind, RIPE, IP2Location и другие), которые отличаются сроком обновления и радиусом определения. Поэтому IP сверяют по нескольким источникам.
Откуда берутся расхождения: пулы IP и геобазы
Интернет-регистраторы выдают операторам пулы IP-адресов. Дальше провайдер распределяет их между городами, корпоративными клиентами, часть сдает в аренду. Единого стандарта «диапазон IP = город» нет. Оператор может сегодня назначить подсеть Петербургу, а через месяц передать другому региону — и не обязан никого уведомлять.
В мобильных сетях ситуация сложнее: геолокация привязана к внутренним справочникам оператора, а NAT на уровне регионов приводит к тому, что трафик миллионов абонентов выходит через пул IP другого региона.
Геобазы собирают данные из реестров регистраторов, геофидов (файлов, где операторы добровольно публикуют соответствие подсетей городам), закрытых данных операторов и сетевых замеров. Геофиды существуют с 2020 года, но заполнять их операторы не обязаны. Если провайдер переназначил подсеть, одна база узнает об этом через неделю, другая — через три месяца. Разные геобазы у площадки и верификатора — почти гарантированное расхождение.
Дмитрий Фролов, операционный директор Adserving:
В Adserving мы определяем гео в CTV в первую очередь по IP, адаптируя набор баз под разные среды. Мы намеренно не полагаемся на один источник: каждый IP проверяется по нескольким базам. При консенсусе мы принимаем этот результат. Если единого ответа нет и результаты по разным базам расходятся, показ помечается как Other. Лучше показать клиенту, что часть трафика не определилась с достаточной точностью, чем выдать недостоверную цифру.
Наталья Лифатова, заместитель генерального директора по техническому развитию Weborama:
В нашей системе геолокация определяется преимущественно по IP с применением дополнительных технических маркеров. Мы используем несколько независимых баз геолокации для сопоставления IP с регионами и городами, что расширяет полноту покрытия и улучшает качество определения.
Юрий Назаричев, руководитель аналитики AdRiver:
Основной метод AdRiver — сопоставление IP рекламного запроса с географическими базами. В отдельных случаях данные уточняются через партнеров или мобильные приложения при наличии разрешения пользователя. Обращение к нескольким независимым источникам минимизирует погрешности и помогает рекламодателям принимать обоснованные решения.
Разные методы и трактовка границ
Геобазы по-разному определяют «попадание в город». Для MaxMind это точное совпадение или заданный радиус, для IP2Location — радиус 50 миль. Чем шире радиус, тем выше процент попадания: по данным MaxMind, каждый пятый показ формально уходит за пределы заказанного города. Это базовая характеристика технологии на российском трафике, а не ошибка. Одни системы используют административные границы, другие — агломерации, третьи — радиус вокруг точки.
MaxMind: оценка точности попадания в города
Дмитрий Фролов, операционный директор Adserving:
Главная причина расхождений в том, что на рынке нет единого понимания, где заканчивается город. Города не круглые, а системы определения гео обычно рисуют вокруг центра окружность заданного радиуса. Мы за точку отсчета берем административную границу города: ее легко проверить и объяснить клиенту. Пригороды и города-спутники мы считаем отдельно и помечаем, а не приписываем их к самому городу.
Хороший пример — подмосковные Химки. Площадка может засчитать показ в Химках как показ в Москве, потому что считает по агломерации. А верификатор тот же показ в Москву не засчитает, потому что для него граница города — административная. Формально оба участника правы, потому что пользуются разными определениями города. Но в отчете клиент видит расхождение и читает его как невыполнение KPI. Поэтому мы всегда при сравнении изначально обращаемся к методологии учета гео.
Наталья Лифатова, заместитель генерального директора по техническому развитию Weborama:
Попадание в города-миллионники обычно достигает 85−90%. Для населенных пунктов с меньшим количеством жителей этот бенчмарк существенно снижается. Мы не используем векторные полигоны: IP принадлежит сетевому оборудованию, и вписывать его в административные рамки технически бессмысленно. Диапазон IP привязывается к агломерации на основе сетевой топологии и обозначается точкой с радиусом погрешности.
Юрий Назаричев, руководитель аналитики AdRiver:
Универсального корректного бенчмарка не существует. Точность зависит от типа доступа, оператора, архитектуры сети, наличия NAT-шлюзов, дополнительных геосигналов и специфики кампании. Результаты варьируются от проекта к проекту. Мы не определяем границы по радиусу. Наша задача — установить принадлежность IP к городу через поведенческие сигналы.
Как участники рынка повышают точность
Ни одна компания не ограничивается одной геобазой: чем больше источников, тем выше точность.
Дмитрий Фролов, операционный директор Adserving:
Одного IP-адреса для точного гео недостаточно, поэтому поверх него мы добавляем данные партнеров: телеком-операторов, клиентов и другие датасеты. Но сначала мы проверяем, что сам показ настоящий, и только потом определяем его географию. Гео у нас работает в связке с защитой от фрода: до того как сформировать отчет, мы отсекаем ботов, трафик из дата-центров, прокси и подозрительные всплески показов. Это напрямую влияет на точность — чаще всего IP-геолокацию ломают именно прокси и технические адреса. Пока мы их не отфильтровали из анализа, работать с гео бессмысленно.
Сергей Игнатов, CTO Admon.ai:
Базовую геолокацию мы определяем по IP, а затем уточняем ее с помощью дополнительных сигналов: данных партнеров, CPA-сверок и агрегированных отчетов на базе Stable ID. В CPA-сверках нам часто известен адрес выдачи заказа, что служит отличным калибровочным сигналом. Для оценки географии на агрегированном уровне мы используем Mediascope Cross Web, считая его надежным источником.
Юрий Назаричев, руководитель аналитики AdRiver:
Помимо классического IP-метода, мы используем дополнительные сигналы из партнерских интеграций: например, сведения о домашнем регионе или геолокацию из мобильного приложения. Комбинация источников критически важна, когда данных одного IP недостаточно.
Бенчмарки расхождений: ориентир, а не норма
Бенчмарк — ориентировочный показатель, помогающий понять, какие расхождения в отчетах считаются нормой, а какие требуют разбирательства. Единого отраслевого бенчмарка нет, но участники рынка предлагают свои диапазоны. Процент погрешности зависит от типа трафика: на десктопе расхождений меньше, в мобильных сетях — больше из-за «плавающих» IP. На основе анализа кампаний через getads мы сформулировали ориентировочные диапазоны расхождений для разных населенных пунктов. Эксперты рынка прокомментировали их.
Бенчмарки по возможным расхождениям при определении географии
Дмитрий Фролов, операционный директор Adserving:
Диапазоны выглядят разумно: чем меньше город, тем меньше данных для подтверждения гео, и расхождения ожидаемо выше. Однако я бы не стал утверждать эти проценты как официальную норму. Эти цифры работают только в связке с методикой измерения. Мы читаем эти проценты не как ошибку, а как зону неопределенности: если данных не хватает, честнее отнести показ к Other или к региону, чем демонстрировать клиенту иллюзорную детализацию.
Наталья Лифатова, заместитель генерального директора по техническому развитию Weborama:
Предложенные бенчмарки объективно отражают технические особенности IP-протокола. На уровне страны или крупного региона точность стремится к 100%, так как магистральные пулы жестко распределены. На более низких уровнях расхождения резко растут.
Юрий Назаричев, руководитель аналитики AdRiver:
Эти значения можно использовать как ориентиры, но не как универсальный стандарт. Для крупных городов точность выше из-за большего объема данных. Для малых населенных пунктов чаще применяется привязка к региону, что снижает риск некорректной детализации. Если данных недостаточно, точная геопривязка просто не присваивается. В таких случаях корректнее говорить о снижении полноты покрытия, а не о росте ошибки.
Что делать рынку
Отсутствие бенчмарка объясняется сложностью измерения точности по уровням населенных пунктов. Для повышения прозрачности рынку нужны два шага.
Первый — единая методология измерения. Без согласованного определения того, что считается городом и попаданием в цель, любые бенчмарки будут оспариваться.
Второй — прозрачность со стороны операторов связи. Механизм публикации сведений о переназначении IP-подсетей существует с 2020 года, но используется редко. Его внедрение позволит получать актуальные данные напрямую, снижая зависимость от косвенных признаков.
Что это значит для рекламодателя
При следующем расхождении в отчетах не спешите обвинять площадку или верификатора. Сначала уточните методологию: считает ли источник гео по административной границе, агломерации или радиусу? Какие геобазы использует? Ответы помогут понять, чем обусловлена разница в цифрах — технической погрешностью, разными определениями города или реальной ошибкой.
Синхронизация методологий позволит получать сопоставимые данные. А пока рынок к этому идет, знание основ IP-геолокации поможет рекламодателю задавать правильные вопросы и принимать решения на основе полной картины, а не только итоговых процентов в отчете.
