지역 타기팅과 국가별 분석: 위치 데이터를 정직하게 읽는 법
- geo-targeting
- analytics
- traffic-quality
이 페이지의 목차
국가별 차트는 링크 도구가 가장 먼저 보여 주는 것이면서 결정을 가장 늦게 바꾸는 것입니다. 어떤 캠페인의 38%가 한 국가에서 왔다는 사실은 그 사람들이 정말 그 국가에 있었는지, 어떤 네트워크가 그들을 실어 왔는지, 그들이 서 있던 곳은 몇 시였는지에 대해 아무것도 말해 주지 않습니다.
이 글은 국가별 차트 아래에 놓인 계층을 다룹니다. 국가와 지역, 도시가 실제로 어디에서 오는지, 정확도 반경이 무엇을 뜻하는지, 방문자가 지나온 네트워크가 왜 그가 출발한 장소와는 별개의 축인지, 방문자 자신의 현지 시각으로 본 활동이 여러분의 보고서 시간대로 본 활동과 어떻게 다른지, 국가와 언어에 따른 라우팅이 무엇을 하고 어디에서 멈추는지, 그리고 위치 데이터를 자신만만한 오답으로 어김없이 바꿔 놓는 세 가지 실수입니다.
국가와 지역, 도시는 어디에서 오는가
같은 질문에 두 출처가 서로 다른 상세 수준으로 답하며, 어느 쪽이 답했는지를 아는 것이 답 자체보다 중요합니다.
먼저 답하는 것은 네트워크입니다
엣지 네트워크 위의 리디렉션에 도달하는 모든 요청은 네트워크가 스스로 해석해 둔 항목을 이미 지니고 옵니다. 국가, 지역, 도시, 대략적인 좌표, 시간대, 자율 시스템 번호, 그리고 그 번호를 보유한 조직의 이름입니다. 이 값들은 비용이 전혀 들지 않습니다. 데이터베이스를 읽지도, 어딘가를 다녀오지도 않습니다. 그러면서 국가만 있으면 되는 판단에는 충분하며, 빠른 라우팅이 바로 이 값들 위에서 돌아가는 이유가 여기에 있습니다.
라이선스를 받은 데이터베이스는 더 자세히 답합니다
엣지에서 한 번 읽어 끝내도록 만든 형식으로 오프라인에서 다시 묶은 상용 지리 데이터베이스는 네트워크 수준의 답이 담지 못하는 것을 더합니다. 도시의 정확도 반경, 지역과 도시 뒤에 놓인 GeoNames 식별자, 여덟 개 언어로 된 안정적인 지명, 주소 대역의 프록시 종류, 그리고 네트워크가 주지 않은 경우의 자율 시스템 번호입니다. 지역 정보와 트래픽 품질 분류는 바로 이 계층 위에 올라가 있습니다.
흥미로운 대목은 고장 났을 때의 동작입니다. 데이터 묶음을 읽을 수 없어도 리디렉션은 계속 동작하고 분석도 계속 기록됩니다. 해석기는 네트워크 수준의 답으로 내려앉고 그 행에 어느 출처가 답했는지 표시하므로, 차트가 정확한 데이터와 근사값을 소리 없이 섞는 일은 없습니다. 대체 경로로 답한 행에는 도시 식별자도 정확도 반경도 없으며, 화면은 여러분이 짐작하도록 내버려 두는 대신 그 사실을 그대로 말합니다.
이름이 아니라 식별자를 저장합니다
클릭 이벤트에는 식별자가 저장되며, 현지화된 지명은 결코 저장되지 않습니다. 구현 세부처럼 들리지만 실제로는 한 줄이 되느냐 두 줄이 되느냐를 가르는 차이입니다. 'Bavaria'와 'Bayern'은 같은 GeoNames 식별자이며, 문자열을 저장하는 보고서라면 이 둘을 영원히 서로 다른 지역으로 줄 세울 것입니다.
이름은 보고서를 읽는 시점에 읽는 사람이 쓰는 언어의 사전에서 해석됩니다. 대시보드가 지원하는 열 개 언어 가운데 여덟 개에 지명이 있고, 나머지 둘은 빈칸이 아니라 영어로 대체됩니다. 언어는 요청 파라미터가 아니라 읽는 사람 자신의 계정 설정에서 가져오는데, 파라미터로 받으면 한 사람이 워크스페이스 전체가 함께 쓰는 캐시에 자기 언어를 박아 넣을 수 있기 때문입니다.
지도를 정직하게 만드는 것은 정확도 반경입니다
도시 레코드는 위치가 아닙니다. 점 하나에 반경이 붙은 것이고, 그 점이 얼마나 값어치가 있는지 알려 주는 쪽은 반경입니다. 20킬로미터라는 반경은 사업자가 그 일대 어딘가에 배정한 주소의 범위를 가리킬 뿐, 사람 한 명도 동네 하나도 매장 하나의 상권도 가리키지 않습니다.
여기에서 두 가지 설계 선택이 따라 나옵니다. 좌표는 1도의 1만분의 1을 단위로 하는 정수로 저장합니다. 소수점을 더 붙여 봐야 원본 데이터에 없는 정밀도를 지어낼 뿐이기 때문입니다. 그리고 반경 0은 '정확함'이 아니라 '알 수 없음'을 뜻하니, 누군가 내보낸 데이터로 지도를 만들기 전에 확인해 둘 만합니다.
실무 규칙은 이렇습니다. 도시 데이터는 시장을 비교하고 쏠림을 찾아내는 데 쓰되, 레코드 몇 건으로 무언가를 단정하는 데에는 쓰지 마십시오. 대체 경로로 답한 행에서는 아예 쓰지 마십시오.
도시와 네트워크는 서로 다른 축입니다
클릭이 온 장소와 클릭이 지나온 네트워크는 서로 다른 질문이며, 앞의 하나에만 답하다가 미디어 바이어는 애초에 전환될 리 없던 트래픽에 돈을 치릅니다. 네트워크 분류는 자율 시스템 번호와 제공업체 이름, 해당 대역의 프록시 종류를 늘어놓고, 실제로 일하는 열인 사람의 클릭 수를 총 클릭 수 옆에 나란히 놓습니다. 어느 한 제공업체에서 이 두 열이 벌어진 폭이 대개 발견의 전부입니다.
| 대역 표시 | 이 대역이 무엇인지 | | --- | --- | | 데이터센터 | 호스팅과 클라우드, 코로케이션 주소 공간 | | 공개 프록시 | 누구나 거쳐 갈 수 있는 열린 중계기 | | VPN | 상용 VPN의 출구 대역 | | 검색 엔진 크롤러 | 검색 엔진이 공개한 크롤러 대역 | | TOR | TOR 네트워크의 출구 노드 | | 웹 익명화 서비스 | 브라우저로 쓰는 프록시 서비스 |
이 가운데 어디에도 속하지 않는 대역은 평범한 주소이며, 표시가 붙은 무리 가운데 가장 큰 것은 소비자용 VPN이 아니라 데이터센터입니다. 이 표시는 다른 신호와 함께 묶입니다. 검증된 크롤러 목록, 목록을 공개하지 않는 로봇을 위한 역방향 조회, 사용자 에이전트 패턴, 요청 행동이 함께 들어가 방문자 종류와 0에서 100까지의 품질 점수를 그 근거와 함께 만들어 냅니다. 점수 자체는 아무것도 막지 않습니다. 차단은 트래픽 규칙 문서에서 여러분이 설정하는 것이고, 점수는 판정을 설명하고 보고서에 반영되기 위해 존재합니다. 분류가 어떻게 동작하는지는 트래픽 필터링 규칙에서 다룹니다.
일부러 어긋나게 둔 곳이 한 군데 있습니다. 필터링 분류, 트래픽 품질, 네트워크 세 화면은 '봇 제외'가 켜져 있어도 자동화된 트래픽을 포함합니다. 애초에 봇을 보려고 연 화면에서 봇을 빼면 화면이 텅 비기 때문입니다. 그 밖의 모든 곳에서 이 필터는 평소대로 동작하며, 자동화된 트래픽이 요금제의 집계 클릭 한도를 잡아먹는 일은 결코 없습니다.
방문자 자신의 시계로 본 활동
보고서는 시간대 하나로 그릴 수 있습니다. 클릭은 저마다 자기 시간대를 갖습니다. 저장된 시각을 워크스페이스 시간대로 변환하면 세 시장의 저녁 봉우리가 평평하게 눌려, 오디언스에게 아무 생활 리듬도 없는 것처럼 보이는 고원이 됩니다.
그래서 현지 시각은 클릭을 기록하는 순간에 그 방문자에게 해석된 시간대로 계산해 행에 함께 저장합니다. 파이프라인에서 방문자 자신의 시간대를 아직 알고 있는 유일한 지점이기 때문입니다. 그 대가로 얻는 것은 여러 시장을 함께 도는 캠페인에서도 무너지지 않는 발송 시각의 답입니다. 여러분의 서버가 바빴던 시각이 아니라 오디언스가 실제로 무언가를 여는 시각입니다.
정직하게 말하면 대가가 있습니다. 위치 해석에 붙은 단서가 그대로 따라온다는 점입니다. 다른 국가의 출구 노드를 거쳐 온 클릭은 그 국가의 시각을 지니고, 대체 경로로 답한 행은 네트워크가 알려 준 시간대를 그대로 지닙니다. 현지 시각 차트를 네트워크 분류와 나란히 읽어야 하는 이유는 도시 차트를 그렇게 읽어야 하는 이유와 같습니다.
국가와 언어에 따라 목적지를 나누기
짧은 주소 하나에 목적지는 여럿입니다. 독일 방문자는 독일 상점에, 프랑스어를 쓰는 벨기에 방문자는 프랑스어 페이지에, 나머지는 모두 기본 사이트에 도착합니다. 타기팅 규칙은 순서가 있는 목록이고, 규칙 안의 조건들은 '그리고'로 묶이며, 온전히 일치한 첫 규칙이 이깁니다. 구체성 점수가 아니라 손으로 순서를 매기게 한 것은 의도한 맞바꿈입니다. 순서가 있는 목록은 소리 내어 읽을 수 있지만, 우선순위 표는 항목이 셋만 넘어가도 아예 디버깅할 수 없기 때문입니다.
언어 대조에는 외워 둘 만한 규칙이 하나 있습니다. en은 모든 지역 변종을 아우르므로 en-GB와 en-US가 모두 여기에 걸리지만, en-GB는 정확히 일치해야 하므로 미국 영어를 잡지 못합니다. 언어를 뜻할 때에는 넓은 쪽을, 시장을 뜻할 때에는 구체적인 쪽을 쓰십시오.
데이터가 없다고 해서 차단으로 이어지는 일은 결코 없습니다. 조건을 판정할 수 없으면, 이를테면 국가를 알 수 없거나 데이터 묶음을 쓸 수 없으면, 그 규칙은 그냥 걸리지 않고 방문자는 기본 목적지로 계속 갑니다. 트래픽 규칙 문서에도 같은 원칙이 분명하게 적혀 있습니다. 모든 조건은 충족됨, 충족되지 않음, 알 수 없음의 세 가지 값을 가지고, 알 수 없는 조건이 하나라도 있는 규칙은 통째로 건너뛰며, 뒤집기는 확실한 답에만 동작합니다. 그래서 '이 국가들만 허용'이라고 쓴 규칙이 조회 실패 하나로 온 세상을 잠가 버리지 않습니다.
처리 순서는 고정되어 있습니다. 먼저 트래픽 규칙입니다. '이 요청에 응답하기는 해야 하는가'에 답하기 때문입니다. 그다음이 타기팅, 그다음이 분할 테스트, 마지막이 기본 목적지입니다. 로테이터의 목적지별 국가 조건은 지역 정보가 선택지를 좁히는 네 번째 자리입니다. 타기팅은 어느 시장이 어디로 갈지 정하고, 로테이터는 그 시장의 트래픽을 어떻게 나눌지 정합니다.
라우팅은 콘텐츠 바꿔치기가 아닙니다
이 구분은 보기보다 중요합니다. 라우팅은 사람을 어느 실제 목적지로 보낼지 고르는 일이고, 모든 목적지는 누구나 열어서 그대로 볼 수 있는 페이지입니다. 콘텐츠 바꿔치기는 주소 하나가 묻는 쪽에 따라 다른 것을 그려 내는 일이며, 그중에서 검색 엔진이 문제 삼는 판은 사람이라면 결코 보지 못할 것을 크롤러에게 보여 주는 쪽입니다.
리디렉터는 목적지 페이지를 그리지도 고쳐 쓰지도 않습니다. 리디렉션으로 응답할 뿐이고 페이지는 목적지가 직접 내놓습니다. 요청이 리디렉션 아닌 것을 받는 곳은 딱 한 군데, 소셜 미리보기 크롤러입니다. 여기에는 링크 자신의 미리보기 메타데이터로 응답하므로, 공유된 링크는 크롤러가 어디에서 돌든 같은 카드로 보입니다. 이것은 미리보기이지 대신 내주는 페이지가 아닙니다.
규칙으로 검증된 크롤러를 따로 다룰 수도 있습니다. 통과시키거나, 링크를 닫거나, 안내용 페이지로 보내는 식입니다. 플랫폼이 주는 것은 그 장치와, 클릭이 단 한 건도 일어나기 전에 특정한 방문자 조건에서 어느 규칙이 걸릴지 보여 주는 미리보기와, 그 뒤에 무엇이 걸렸는지 남는 기록입니다. 크롤러가 사람과 다른 것을 받아야 하는지는 여러분이 지는 결정이며, 그 기록이 이 결정을 나중에 확인할 수 있게 만듭니다.
지역 데이터가 자신만만한 오답을 만들어 내는 세 가지 길
그 시장에 있지도 않았던 트래픽으로 시장을 읽는 것. 차트에서 올라오는 국가는 무엇이 그 트래픽을 실어 왔는지 들여다보기 전까지는 수요의 증거가 아닙니다. 그 국가의 클릭 대부분이 데이터센터 대역이나 상용 VPN 출구에서 온다면, 여러분이 보고 있는 것은 구매자가 있는 곳이 아니라 출구 노드가 있는 곳입니다. 이 목록에서 가장 비싼 실수인데, 계획을 만들어 내기 때문입니다. 예산이 움직이고 소재가 현지화되지만, 그중 어느 것도 사람에게 닿지 않습니다.
물량을 함께 세지 않고 국가만 줄 세우는 것. 클릭 90회에 전환율 4.4%인 시장이 9,000회 클릭에 3.9%인 시장을 앞서고 있는 것이 아닙니다. 그 시장은 이벤트 네 건만 더 있어도 여러분이 들뜬 그 격차보다 더 크게 숫자가 흔들리는 시장입니다. 국가가 순위에 들어오기 위한 최소 물량을 정하고, 눈에 보이는 차이를 이벤트 몇 건이 그 숫자를 얼마나 움직이는지와 견주어 보십시오. 통계적 순수성이 목적이 아니라, 잡음을 중심으로 한 분기를 통째로 재편하지 않는 것이 목적입니다.
데이터가 지역까지만 뒷받침하는데 도시를 믿는 것. 도시 행에는 반경이 함께 붙고, 아예 도시가 없는 행도 있습니다. 반경이 나라 절반을 덮는 행 위에 대도시권 하나를 겨냥해 세운 캠페인은 반올림이 남긴 자국 위에 세운 계획입니다. 매장 개점이나 행사, 지역 한정 프로모션처럼 질문에 정말로 도시가 필요할 때에는, 바탕이 되는 행 가운데 몇 건이 도시 식별자를 지녔고 그 반경이 어떤지부터 확인한 다음에 움직이십시오. 뒷받침되지 않으면 지역을 쓰십시오. 지역은 안정적이고 식별자로 뒷받침되며 잘못 읽기가 훨씬 어렵습니다.
네 번째 습관 하나가 이 셋이 겹쳐 커지는 것을 막습니다. 지역 분류는 링크 클릭 추적에 정리된 클릭 품질의 단서와 나란히 읽으십시오. 그리고 순 방문자는 하루 단위 지표라는 것을 기억하십시오. 한 달치 국가 비교는 서로 다른 사람을 세는 것이 아니라 하루치 순 방문자를 더한 값입니다.
이 데이터가 일부러 담지 않는 것
방문자의 주소는 결코 저장하지 않습니다. 주소는 함수 하나 안에서 일별 솔트 지문을 만들고 주소 대역을 조회할 만큼만 존재하며, 이벤트에는 도달하지 않습니다. 우편번호는 데이터베이스가 해석하지만 일부러 기록하지 않습니다. 주거가 밀집한 곳에서 우편번호는 주소에 가깝기 때문입니다.
나머지를 얼마나 저장할지는 워크스페이스 설정이며, 읽는 시점이 아니라 이벤트를 기록하는 시점에 적용됩니다.
| 수준 | 저장되는 것 | | --- | --- | | 전체 상세 | 국가, 지역, 도시, 좌표, 정확도 반경, 시간대, 현지 시각 | | 좌표 없는 도시 | 국가, 지역, 도시, 시간대, 현지 시각 | | 국가만 | 국가와 대륙 |
방문자의 네트워크, 전체 유입 주소, 트래픽 종류 판별은 각각 따로 있는 스위치가 맡습니다. 보관 기간은 이벤트마다 며칠인지가 함께 적히는데, 이는 요금제가 얼마나 과거까지 볼 수 있는지 제한하는 것과는 다른 이야기입니다. 그리고 설정 변경은 다음 캐시 만료를 기다리지 않고 살아 있는 링크에 몇 초 안에 닿습니다. 자세한 내용은 개인정보 보호 모드 문서와 지역 분석 문서에 있습니다.
출력 쪽 한계 하나는 잘못 짐작하기 쉽습니다. 링크의 공개 통계 페이지는 이 가운데 국가와 도시만 보여 줍니다. 네트워크도, 트래픽 종류도, 품질 점수도, 좌표도 없습니다. 이 경계는 관행에 맡겨 두는 대신 응답의 모양을 확인하는 테스트로 검사합니다.
따져 물어도 버티는 설정
- 비용을 치르는 캠페인에서는 국가별 차트보다 네트워크 분류를 먼저 읽고, 제공업체별로 사람의 클릭 수를 총 클릭 수와 견주어 보십시오.
- 그 아래로는 국가가 순위에 들어오지 못하는 최소 클릭 물량을 정하고, 회의 때마다 다시 흥정하지 않도록 문서로 남기십시오.
- 도시에 기대는 결정을 내리기 전에 정확도 반경을 확인하고, 반경이 도시를 뒷받침하지 못하면 지역으로 물러서십시오.
- 타기팅 규칙을 공개하기 전에 특정 방문자 조건이 무엇을 받을지 미리보기로 확인하고, 실제 운영에서 여러분 자신의 트래픽으로 시험하지 마십시오.
- 지역 정보의 상세 수준은 의식하고 고르십시오. 이 선택이 무엇을 기록할지 정하며, 꺼 둔 것은 나중에 되살릴 수 없습니다.
- 캠페인마다 한 번은 분석을 목적지 쪽 데이터와 대조하십시오. 특히 둘이 가장 크게 어긋나는 시장에서 그렇게 하십시오.
위치 데이터는 질문 하나가 아니라 둘로 다룰 때 가장 잘 듣습니다. 요청이 어디에서 온 것처럼 보이는가, 그리고 무엇이 그 요청을 실어 왔는가입니다. 앞의 하나만으로도 차트는 언제나 나옵니다. 그 차트를 실행에 옮길 만한 것으로 만들어 주는 쪽은 뒤의 하나입니다. 미디어 바이어가 이 문제에 가장 먼저 부딪히며, 제휴 마케팅 솔루션이 지도보다 네트워크와 품질 축에 기대는 이유가 여기에 있습니다.
많이 묻는 질문
도시 단위 위치 데이터는 얼마나 정확합니까?
시장을 비교하기에는 충분하고 사람을 설명하기에는 부족합니다. 그리고 정직한 답은 형용사가 아니라 숫자입니다. 도시 레코드에는 모두 정확도 반경이 붙으며, 반경이 수십 킬로미터라는 것은 그 레코드가 네트워크 사업자가 그 일대 어딘가에 배정한 주소의 범위를 가리킨다는 뜻입니다. 이동통신사와 회사 네트워크는 방문자를 실제로 서 있는 곳에서 한참 떨어진 자리에 놓기 일쑤인데, 주소가 단말기가 아니라 밖으로 나가는 지점에 속하기 때문입니다. 도시 이름을 읽기 전에 반경부터 읽으십시오.
클릭의 국가 정보는 실제로 어디에서 옵니까?
역할이 다른 두 출처에서 옵니다. 요청을 받아 내는 엣지 네트워크는 국가와 지역, 도시, 좌표, 시간대, 자율 시스템을 조회 없이 비용도 없이 해석해 주며, 빠른 라우팅 판단이 쓰는 답이 바로 이것입니다. 라이선스를 받은 지리 데이터베이스는 여기에 더 자세히 답합니다. 정확도 반경, 지역과 도시 뒤에 놓인 GeoNames 식별자, 여덟 개 언어로 된 안정적인 지명, 그리고 해당 주소 대역의 프록시 종류입니다. 저장되는 행마다 어느 출처가 답했는지가 함께 기록되므로, 근사값인 행은 정확한 행에 뒤섞이는 대신 그렇게 표시됩니다.
VPN을 쓰면 지역 분석이 망가집니까?
VPN은 방문자를 출구 노드로 옮겨 놓으며, 그것이 바로 방문자가 VPN에게 시킨 일입니다. 여기에 대한 대비책은 더 정밀한 위치 해석이 아니라 두 번째 축입니다. 네트워크 분류는 주소 대역을 데이터센터, 상용 VPN, 공개 프록시, TOR 출구 노드, 웹 익명화 서비스로 표시하고, 사람의 클릭 수를 총 클릭 수와 나누어 보여 줍니다. 표시된 비중은 전수 조사가 아니라 하한선으로 다루십시오. 탐지는 알려진 대역을 대상으로 동작하므로, 평범한 가정용 주소에서 돌아가는 프록시는 평범한 트래픽으로 읽힙니다.
국가별 라우팅과 콘텐츠 바꿔치기는 무엇이 다릅니까?
라우팅은 방문자를 어느 실제 목적지로 보낼지 고르는 일이며, 모든 목적지는 누구나 열어서 그대로 볼 수 있는 페이지입니다. 콘텐츠 바꿔치기는 주소 하나가 묻는 쪽에 따라 다른 내용을 그려 내는 것이고, 크롤러가 받는 판이 사람이 받는 판과 다를 때 정책 문제가 됩니다. 리디렉터는 목적지 페이지를 그리지도 고쳐 쓰지도 않습니다. 리디렉션으로 응답할 뿐이고 페이지는 목적지가 직접 내놓습니다. 소셜 미리보기 크롤러에는 링크 자신의 미리보기 메타데이터로 응답하므로 공유된 링크는 어디서나 한결같은 카드로 보이며, 이것은 다른 페이지가 아니라 미리보기입니다.
현지 시각별 활동은 시간대별 활동과 무엇이 다릅니까?
보고서는 시간대 하나로만 그릴 수 있는데 클릭은 저마다 자기 시간대를 갖기 때문입니다. 저장된 시각을 워크스페이스 시간대로 변환하면 세 시장에서 저녁마다 솟던 봉우리가 뭉개져 평평한 고원이 됩니다. 그래서 현지 시각은 클릭을 기록하는 순간에 그 방문자에게 해석된 시간대로 계산해 행에 함께 저장합니다. 이 설계가 치르는 비용은 위치 해석에 붙은 단서가 그대로 따라온다는 점입니다. VPN을 거쳐 온 클릭은 사람의 시각이 아니라 출구 노드의 시각을 지닙니다.
개인정보 보호를 위해 지역 정보의 상세 수준을 낮출 수 있습니까?
워크스페이스마다 낮출 수 있으며, 읽는 시점이 아니라 기록하는 시점에 적용됩니다. 전체 상세는 국가와 지역, 도시, 좌표, 정확도 반경, 시간대, 현지 시각을 저장하고, 중간 수준은 도시는 남기되 지도 위의 점은 버리며, 국가만 남기는 수준은 대륙과 국가만 남깁니다. 어떤 수준이 끄는 것은 아예 기록되지 않으므로, 어떤 보고서도 어떤 내보내기도 나중의 어떤 질의도 그것을 되살릴 수 없습니다. 방문자의 주소는 어느 수준에서도 저장하지 않으며, 우편번호는 조회 과정에서 해석은 하되 일부러 기록하지 않습니다.