Перейти к содержимому
LinkProfit

Гео-таргетинг и аналитика по странам: как честно читать данные о месте

LinkProfit Team10 мин чтения
  • geo-targeting
  • analytics
  • traffic-quality
На этой странице

График по странам — первое, что показывает любой сервис ссылок, и последнее, что меняет хоть какое-то решение. Тридцать восемь процентов кампании пришли из одной страны: это не говорит ни о том, были ли те люди в этой стране, ни о том, какая сеть их принесла, ни о том, который был час там, где они стояли.

Этот гид — о слое под графиком по странам: откуда на самом деле берутся страна, регион и город, что означает радиус точности, почему сеть, из которой пришёл посетитель, — это отдельная ось от места, откуда он пришёл, чем активность по местному часу посетителя отличается от активности в вашем отчётном поясе, что умеет маршрутизация по стране и языку и где она останавливается, и три ошибки, которые надёжно превращают данные о месте в уверенные неверные ответы.

Откуда берутся страна, регион и город

На один и тот же вопрос отвечают два источника с разной подробностью, и знать, который из них ответил, важнее самого ответа.

Первой отвечает сеть

Любой запрос, дошедший до редиректа на edge-сети, приходит уже с полями, которые сеть определила сама: страна, регион, город, приблизительные координаты, часовой пояс, номер автономной системы и название владеющей ею организации. Стоят они ничего — ни чтения базы, ни сетевого обращения — и их достаточно для любого решения, которому нужна только страна; поэтому именно на них работает быстрая маршрутизация.

Лицензированная база отвечает подробнее

Коммерческая гео-база, переупакованная офлайн в формат под поиск на edge за одно чтение, добавляет то, чего сетевой ответ не несёт: радиус точности города, идентификаторы GeoNames за регионом и городом, устойчивые названия мест на восьми языках, тип прокси у диапазона адресов и номер автономной системы там, где сеть его не дала. Разбивки географии и качества трафика построены именно на этом слое.

Интереснее всего то, как это ломается. Если пакет прочитать не удаётся, редиректы продолжают работать, а аналитика — записываться: резолвер спускается к сетевому ответу и помечает строку источником, который её дал, поэтому график никогда не смешивает точные и приблизительные данные молча. У строк с запасного пути нет ни идентификатора города, ни радиуса точности, и интерфейс говорит об этом прямо, вместо того чтобы оставлять вас догадываться.

Идентификаторы вместо названий

Событие клика хранит идентификатор и никогда — локализованное название места. Звучит как деталь реализации, а на деле это разница между одной строкой и двумя: «Bavaria» и «Bayern» — это один и тот же идентификатор GeoNames, а отчёт, который хранил бы названия текстом, вечно считал бы их разными регионами.

Названия разрешаются в момент чтения отчёта, по словарю того языка, которым пользуется читатель: названия мест есть на восьми из десяти языков панели, а оставшиеся два откатываются к английскому, а не к пустой ячейке. Язык берётся из настройки самого читателя, а не из параметра запроса: параметр позволил бы одному человеку закрепить свой язык в кэше, общем для всего рабочего пространства.

Радиус точности не даёт карте соврать

Запись города — это не местоположение. Это точка плюс радиус, и именно радиус говорит, чего стоит эта точка. Двадцать километров описывают диапазон адресов, который оператор выдал где-то в этой области; они не описывают ни человека, ни район, ни зону притяжения магазина.

Отсюда два решения в устройстве. Координаты хранятся целыми десятитысячными долями градуса, потому что лишние знаки после запятой изготавливают точность, которой в исходных данных нет. А нулевой радиус означает «неизвестно», а не «точно» — это стоит проверить раньше, чем кто-нибудь построит карту из выгрузки.

Практическое правило: данными о городах пользуйтесь, чтобы сравнивать рынки и замечать концентрации, а не чтобы делать выводы из горстки записей, — и вовсе не пользуйтесь ими на строках, отвеченных запасным путём.

Город и сеть — это разные оси

Место, откуда пришёл клик, и сеть, через которую он пришёл, — это разные вопросы, и именно ответ только на первый заставляет медиабайеров платить за трафик, у которого не было ни единого шанса сконвертироваться. Разбивка по сетям перечисляет номер автономной системы, название провайдера, тип прокси у этого диапазона и — та самая колонка, которая всё и делает — клики людей рядом со всеми кликами. Разрыв между этими двумя колонками у одного провайдера обычно и есть вся находка.

| Метка диапазона | Что представляет собой диапазон | | --- | --- | | Дата-центр | Адреса хостинга, облаков и колокации | | Открытый прокси | Открытые узлы, через которые может пройти кто угодно | | VPN | Диапазоны выходных узлов коммерческих VPN | | Поисковый робот | Опубликованные диапазоны краулеров поисковых систем | | TOR | Выходные узлы сети TOR | | Веб-анонимайзер | Прокси-сервисы, работающие в браузере |

Диапазоны, не попавшие ни под одну из этих меток, — обычные адреса, а самая крупная размеченная группа с большим отрывом — дата-центры, а вовсе не потребительские VPN. Эта метка складывается с другими сигналами — списками проверенных краулеров, обратной сверкой имени для роботов, которые списков не публикуют, шаблонами user agent, поведением запросов — в тип посетителя и оценку качества от 0 до 100 с приложенными причинами. Сама по себе оценка ничего не блокирует: блокировка настраивается в правилах трафика, а оценка существует, чтобы объяснить решение и наполнить отчёт. Механика классификации разобрана в фильтрации трафика.

Одна намеренная асимметрия: три панели — отфильтрованный трафик, качество трафика и сети — показывают автоматику даже при включённом переключателе «исключить ботов», потому что исключение ботов опустошило бы ровно те экраны, которые вы открыли, чтобы посмотреть на ботов. В остальных местах фильтр ведёт себя как обычно, а автоматический трафик никогда не расходует включённый в тариф лимит учтённых кликов.

Активность по часам самого посетителя

Отчёт можно построить в одном часовом поясе. У каждого клика он свой. Приведите сохранённые отметки времени к поясу рабочего пространства — и вечерний пик в трёх рынках расплющится в плато, из которого следует, будто у вашей аудитории нет никакого распорядка.

Поэтому местный час считается в момент записи клика, из часового пояса, определённого для этого посетителя, и хранится прямо в строке — в единственной точке конвейера, где собственный пояс посетителя ещё известен. Взамен вы получаете ответ о времени рассылки, который переживает кампанию на несколько рынков: час, в который ваша аудитория действительно что-то открывает, а не час, в который был занят ваш сервер.

Честная цена в том, что оговорки к ответу о месте наследуются. Клик, прошедший через выходной узел в другой стране, несёт час этой страны, а строка, отвеченная запасным путём, несёт тот часовой пояс, который сообщила сеть. Графики по местному часу стоит читать рядом с разбивкой по сетям — по той же причине, по которой это верно для графика городов.

Маршрутизация по стране и языку

Один короткий адрес, разные адреса назначения: посетитель из Германии попадает в немецкий магазин, франкоязычный посетитель из Бельгии — на французскую страницу, все остальные — на основной сайт. Правила таргетинга — это упорядоченный список, условия внутри правила объединяются по «и», и побеждает первое полное совпадение. Ручной порядок вместо оценки специфичности — сознательный размен: упорядоченный список можно прочитать вслух, а таблицу приоритетов, в которой больше трёх записей, отладить нельзя вообще.

В сопоставлении языков есть одно правило, которое стоит запомнить: en покрывает все региональные варианты, поэтому en-GB и en-US оба под него подходят, тогда как en-GB требует точного совпадения и американский английский не поймает. Пишите широкое правило, когда имеете в виду язык, и узкое — когда имеете в виду рынок.

Отсутствие данных никогда не превращается в блокировку. Если условие вычислить невозможно — страна неизвестна, пакет был недоступен, — правило просто не срабатывает, и посетитель идёт на базовый адрес назначения. В правилах трафика тот же принцип заявлен прямо: каждое условие трёхзначно — выполнено, не выполнено или без ответа, — правило с условием без ответа пропускается целиком, а инверсия работает только на уверенных данных, поэтому «пускать только эти страны» не запирает дверь перед всем миром, когда поиск не удался.

Порядок конвейера зафиксирован: сначала правила трафика, потому что они отвечают на вопрос «обслуживать ли этот запрос вообще», затем таргетинг, затем сплит-тест, если он есть, затем базовый адрес назначения. Фильтры по стране у отдельных адресов в ротаторе — четвёртое место, где география сужает выбор: таргетинг решает, куда идёт рынок, а ротатор — как трафик этого рынка делится дальше.

Маршрутизация — это не подмена содержимого

Различие важнее, чем кажется. Маршрутизация выбирает, на какой реальный адрес назначения отправить человека, и каждый такой адрес — страница, которую кто угодно может открыть и увидеть целиком. Подмена содержимого означает, что один адрес отдаёт разное в зависимости от того, кто спрашивает, — и возражают поисковые системы против той разновидности этой практики, когда краулеру показывают то, чего человек не увидит никогда.

Редиректор не отрисовывает и не переписывает страницы назначения: он отвечает редиректом, а страница обслуживает себя сама. Единственное место, где запрос получает что-то кроме редиректа, — краулер превью в соцсетях: ему отдаётся собственная разметка превью этой ссылки, поэтому опубликованная ссылка собирается в одну и ту же карточку независимо от того, откуда пришёл краулер. Это превью, а не страница-подмена.

Правила могут обходиться с проверенными краулерами и иначе: пропускать, закрывать ссылку, уводить на страницу-заглушку. Платформа даёт механизм, предпросмотр того, какое правило сработает на заданном профиле посетителя, ещё до первого клика, и журнал того, что сработало потом. Должен ли краулер получать не то же, что человек, — решаете вы, а журнал делает это решение проверяемым.

Три способа получить из гео-данных уверенный неверный ответ

Читать рынок по трафику, которого в этом рынке не было. Страна, взбирающаяся вверх по вашему графику, — ещё не доказательство спроса, пока вы не посмотрели, что её принесло. Если большая часть её кликов приходит из диапазонов дата-центров или выходных узлов коммерческих VPN, вы смотрите на то, где стоят выходные узлы, а не на то, где живут покупатели. Это самая дорогая ошибка в списке, потому что она порождает план: бюджет переезжает, креатив локализуется, и ничто из этого не доходит до человека.

Ранжировать страны, не ранжируя их объём. Рынок с 90 кликами и конверсией 4,4 % не обгоняет рынок с 9 000 кликов и 3,9 %; это рынок, где четыре лишних события сдвинут число сильнее, чем тот разрыв, которому вы обрадовались. Задайте нижнюю границу объёма, ниже которой страна вообще не попадает в рейтинг, и сравнивайте наблюдаемую разницу с тем, насколько её подвинула бы горстка событий. Смысл не в статистической чистоте, а в том, чтобы не перестраивать квартал вокруг шума.

Доверять городу там, где данные держат только регион. Строки городов приходят с радиусами, а у части строк города нет вовсе. Кампания, построенная под одну агломерацию на строках, радиус которых накрывает полстраны, — это план на артефакте округления. Когда вопрос действительно требует города — открытие магазина, мероприятие, локальная акция, — сначала проверьте, у скольких строк в основе есть идентификатор города и как выглядят их радиусы. Когда они этого не держат, берите регион: он устойчив, опирается на идентификатор и куда труднее поддаётся неверному прочтению.

Четвёртая привычка не даёт этим трём накладываться друг на друга: читайте географические разбивки рядом с оговорками о качестве кликов из гида по отслеживанию кликов по ссылкам и помните, что уникальные посетители — суточная метрика: месячное сравнение стран складывает суточные уникальные, а не считает разных людей.

Чего в этих данных нет намеренно

Адрес посетителя не сохраняется никогда. Он живёт внутри одной функции ровно столько, сколько нужно, чтобы получить суточный отпечаток с солью и найти диапазон адресов, и до события он не доходит. Почтовый индекс база разрешает, но сознательно не записывает: в плотной застройке почтовый индекс — это почти адрес.

Сколько из остального сохраняется — настройка рабочего пространства, применяемая при записи события, а не при его чтении.

| Уровень | Что сохраняется | | --- | --- | | Полный | Страна, регион, город, координаты, радиус точности, часовой пояс, местный час | | Город без координат | Страна, регион, город, часовой пояс, местный час | | Только страна | Страна и континент |

Отдельные переключатели закрывают сеть посетителя, полный адрес источника перехода и определение типа трафика. Срок хранения записывается в каждое событие числом дней — это не то же самое, что тарифное ограничение на глубину просмотра, — а изменения доходят до живых ссылок за секунды, а не к следующему истечению кэша. Подробности — в режимах приватности и в гиде по географии.

Одно ограничение на выходе легко предположить неверно: публичная страница статистики ссылки показывает из всего этого только страну и город — ни сетей, ни типа трафика, ни оценки качества, ни координат. Эту границу проверяет тест на форму ответа, а не оставленная на честное слово договорённость.

Настройка, которая выдержит проверку

  1. На любой кампании, за которую вы платите, читайте разбивку по сетям раньше графика по странам, сравнивая клики людей со всеми кликами по каждому провайдеру.
  2. Задайте минимальный объём кликов, ниже которого страна не попадает в рейтинг, и запишите его, чтобы его не пересматривали на каждой встрече.
  3. Проверяйте радиус точности перед любым решением, которое опирается на город, и спускайтесь к региону, когда радиус города не держит.
  4. Прежде чем публиковать правила таргетинга, смотрите в предпросмотре, что получит заданный профиль посетителя, вместо проверки в бою на собственном трафике.
  5. Выбирайте уровень детальности гео-данных осознанно: он решает, что будет записано, а выключенное потом уже не вернуть.
  6. Раз за кампанию сверяйте аналитику с данными на стороне адреса назначения, особенно в тех рынках, где расхождение между ними наибольшее.

Данные о месте лучше всего работают как два вопроса вместо одного: откуда запрос, судя по всему, пришёл и что его принесло. Первый сам по себе всегда даёт график; второй — то, что делает этот график достойным решений. Медиабайеры упираются в это раньше всех, поэтому настройка для арбитража трафика опирается на оси сети и качества, а не на карту.

О чём обычно спрашивают

Насколько точны данные о городе?

Достаточно точны, чтобы сравнивать рынки, и недостаточно, чтобы описать человека, — и честный ответ здесь число, а не прилагательное. У каждой записи города есть радиус точности, и радиус в десятки километров означает, что запись описывает диапазон адресов, которые оператор связи выдал где-то в этой области. Мобильные операторы и корпоративные сети регулярно помещают посетителя далеко от того места, где он находится физически, потому что адрес принадлежит точке выхода, а не его устройству. Читайте радиус раньше, чем название города.

Откуда на самом деле берётся страна клика?

Из двух источников с разными ролями. Сеть на edge, принимающая запрос, определяет страну, регион, город, координаты, часовой пояс и автономную систему бесплатно и без единого поиска — именно на этом ответе работают быстрые решения о маршрутизации. Лицензированная гео-база отвечает подробнее: радиус точности, идентификаторы GeoNames за регионом и городом, устойчивые названия на восьми языках и тип прокси у диапазона адресов. Каждая сохранённая строка запоминает, какой источник на неё ответил, поэтому приблизительная строка помечена, а не подмешана к точным.

Ломает ли VPN гео-аналитику?

Он переносит посетителя к выходному узлу — ровно то, о чём посетитель его и попросил. Защита здесь не в более точной геолокации, а во второй оси: разбивка по сетям помечает диапазон адресов как дата-центр, коммерческий VPN, открытый прокси, выходной узел TOR или веб-анонимайзер и показывает клики людей отдельно от всех кликов. Размеченную долю считайте нижней границей, а не переписью: определение работает по известным диапазонам, и прокси, поднятый на обычных домашних адресах, читается как обычный трафик.

Чем маршрутизация по стране отличается от подмены содержимого?

Маршрутизация выбирает, на какой реальный адрес назначения отправить посетителя, и любой такой адрес — это страница, которую кто угодно может открыть и увидеть целиком. Подмена содержимого означает, что один адрес отдаёт разное в зависимости от того, кто спрашивает, и это становится вопросом политики, когда краулер получает не ту версию, что человек. Редиректор никогда не отрисовывает и не переписывает страницу назначения — он отвечает редиректом, а страница обслуживает себя сама. Краулерам превью в соцсетях отдаётся собственная разметка превью ссылки, чтобы опубликованная ссылка везде собиралась в одну и ту же карточку: это превью, а не другая страница.

Чем активность по местному часу отличается от активности в вашем часовом поясе?

Тем, что отчёт можно построить только в одном часовом поясе, а у каждого клика он свой. Если приводить сохранённые отметки времени к поясу рабочего пространства, вечерний всплеск в трёх рынках размажется в ровное плато. Поэтому местный час считается в момент записи клика, из часового пояса, определённого для этого посетителя, и хранится прямо в строке. Цена такого решения в том, что оговорки к ответу о месте наследуются: клик через VPN несёт час выходного узла, а не час человека.

Можно ли ограничить детальность гео-данных из соображений приватности?

Да, для каждого рабочего пространства, и действует это на записи, а не на чтении. Полная детальность хранит страну, регион, город, координаты, радиус точности, часовой пояс и местный час; средний уровень оставляет город и убирает точку с карты; «только страна» оставляет континент и страну. То, что выключил уровень, не записывается вовсе, поэтому ни один отчёт, ни одна выгрузка и ни один будущий запрос этого не вернут. Адрес посетителя не хранится ни на одном уровне, а почтовый индекс разрешается при поиске, но сознательно не записывается.