Geotargeting e analytics per paese: leggere onestamente i dati di posizione
- geo-targeting
- analytics
- traffic-quality
In questa pagina
- Da dove arrivano paese, regione e città
- La rete risponde per prima
- Un database in licenza risponde con più dettaglio
- Identificatori, non nomi
- Il raggio di precisione è ciò che rende onesta la mappa
- Città e rete sono due assi diversi
- L'attività secondo l'orologio del visitatore
- Instradare per paese e per lingua
- Instradare non è scambiare i contenuti
- Tre modi in cui i dati geografici producono errori detti con sicurezza
- Che cosa i dati deliberatamente non contengono
- Un assetto che regge a un esame attento
Un grafico per paese è la prima cosa che uno strumento di link mostra e l'ultima che cambia una decisione. Il trentotto per cento di una campagna è arrivato da un paese solo: questo non dice niente su quelle persone — se fossero davvero in quel paese, quale rete le abbia portate, che ora fosse nel posto in cui si trovavano.
Questa guida parla dello strato che sta sotto il grafico per paese: da dove arrivano davvero paese, regione e città, che cosa significa il raggio di precisione, perché la rete da cui è arrivato un visitatore è un asse diverso dal luogo da cui è arrivato, in che cosa l'attività per ora locale del visitatore differisce dall'attività nel fuso orario dei tuoi report, che cosa fa l'instradamento per paese e per lingua e dove si ferma, e i tre errori che con affidabile regolarità trasformano i dati di posizione in risposte sbagliate dette con sicurezza.
Da dove arrivano paese, regione e città
Due fonti rispondono alla stessa domanda con un dettaglio diverso, e sapere quale delle due ha risposto conta più della risposta stessa.
La rete risponde per prima
Ogni richiesta che raggiunge un reindirizzamento su una rete edge arriva già con i campi che la rete ha risolto da sé: paese, regione, città, coordinate approssimate, fuso orario, numero di sistema autonomo e nome dell'organizzazione che lo detiene. Non costano niente — nessuna lettura di database, nessun viaggio di rete — e bastano per qualunque decisione a cui serva soltanto un paese, ed è per questo che l'instradamento rapido gira su di loro.
Un database in licenza risponde con più dettaglio
Un database geografico commerciale, reimpacchettato offline in un formato costruito per consultazioni edge a lettura singola, aggiunge quello che una risposta a livello di rete non porta: il raggio di precisione della città, gli identificatori GeoNames dietro regione e città, nomi di luogo stabili in otto lingue, il tipo di proxy dell'intervallo di indirizzi e un numero di sistema autonomo là dove la rete non l'ha fornito. Le ripartizioni di geografia e qualità del traffico sono costruite su quello strato.
La parte interessante è il comportamento in caso di guasto. Se il pacchetto non è leggibile, i reindirizzamenti continuano a funzionare e le analytics continuano a registrare: il risolutore scende alla risposta a livello di rete e segna la riga con la fonte che l'ha prodotta, così un grafico non mescola mai in silenzio dati precisi e dati approssimati. Le righe di ripiego non hanno identificatore di città né raggio di precisione, e l'interfaccia lo dice invece di lasciartelo dedurre.
Identificatori, non nomi
Un evento di clic memorizza un identificatore, mai un nome di luogo tradotto. Sembra un dettaglio implementativo ed è invece la differenza tra una riga e due: «Bavaria» e «Bayern» sono lo stesso identificatore GeoNames, e un report che memorizzasse stringhe le classificherebbe per sempre come due regioni distinte.
I nomi vengono risolti quando il report viene letto, dal dizionario della lingua che chi legge sta usando: otto delle dieci lingue della dashboard hanno i nomi di luogo, e le due restanti ripiegano sull'inglese invece che su una cella vuota. La lingua si prende dall'impostazione dell'account di chi legge e non da un parametro della richiesta, perché un parametro permetterebbe a una sola persona di fissare la propria lingua dentro una cache condivisa da tutta l'area di lavoro.
Il raggio di precisione è ciò che rende onesta la mappa
Un record di città non è una posizione. È un punto più un raggio, e il raggio è la parte che ti dice quanto vale quel punto. Venti chilometri descrivono un intervallo di indirizzi che un operatore ha assegnato da qualche parte in quell'area; non descrivono una persona, un quartiere o il bacino di utenza di un negozio.
Ne discendono due scelte di progetto. Le coordinate sono memorizzate come decimillesimi interi di grado, perché le cifre decimali in più fabbricano una precisione che i dati di origine non hanno. E un raggio pari a zero significa «sconosciuto», non «esatto»: vale la pena ricordarlo prima che qualcuno costruisca una mappa a partire da un'esportazione.
La regola pratica: usa i dati di città per confrontare mercati e individuare concentrazioni, non per concludere qualcosa da una manciata di record, e per niente sulle righe a cui ha risposto il percorso di ripiego.
Città e rete sono due assi diversi
Il posto da cui è arrivato un clic e la rete attraverso cui è passato sono due domande distinte, e rispondere soltanto alla prima è il modo in cui i media buyer pagano traffico che non aveva nessuna possibilità di convertire. La ripartizione per rete elenca il numero di sistema autonomo, il nome del provider, il tipo di proxy di quell'intervallo e — la colonna che fa il lavoro — i clic umani accanto ai clic totali. Lo scarto tra queste due colonne su un singolo provider è di solito tutta la scoperta.
| Etichetta dell'intervallo | Che cos'è l'intervallo | | --- | --- | | Data center | Spazio di indirizzi di hosting, cloud e colocation | | Proxy pubblico | Relay aperti attraverso cui chiunque può instradare | | VPN | Intervalli di uscita delle VPN commerciali | | Robot di ricerca | Intervalli pubblicati dei crawler dei motori di ricerca | | TOR | Nodi di uscita della rete TOR | | Anonimizzatore web | Servizi proxy che girano dentro il browser |
Gli intervalli che non appartengono a nessuna di queste categorie sono indirizzi ordinari, e il gruppo etichettato di gran lunga più grande è quello dei data center, non delle VPN per consumatori. Quell'etichetta viene combinata con altri segnali — liste di crawler verificati, risoluzione inversa per i robot che non pubblicano nessuna lista, pattern dello user agent, comportamento delle richieste — in un tipo di visitatore e in un punteggio di qualità da 0 a 100 con le sue motivazioni allegate. Il punteggio da solo non blocca niente: il blocco è quello che configuri nelle regole di traffico, e il punteggio esiste per spiegare un verdetto e alimentare il report. La meccanica della classificazione è descritta nel filtro del traffico.
Un'asimmetria voluta: tre pannelli — traffico filtrato, qualità del traffico e reti — includono il traffico automatico anche quando l'interruttore «escludi i bot» è attivo, perché escludere i bot lì svuoterebbe proprio le schermate che hai aperto per guardare i bot. Ovunque altrove il filtro si comporta normalmente, e il traffico automatico non consuma mai la quota di clic tracciati di un piano.
L'attività secondo l'orologio del visitatore
Un report si può disegnare in un solo fuso orario. Ogni clic ha il suo. Converti gli istanti memorizzati nel fuso di un'area di lavoro e un picco serale in tre mercati si appiattisce in un altopiano che suggerisce un pubblico senza orari.
L'ora locale viene quindi calcolata quando il clic viene scritto, dal fuso orario risolto per quel visitatore, e conservata sulla riga — l'unico punto della catena in cui il fuso del visitatore stesso è ancora noto. Quello che ci guadagni è una risposta sull'orario di invio che regge in una campagna su più mercati: l'ora in cui il tuo pubblico apre davvero le cose, invece dell'ora in cui erano occupati i tuoi sistemi.
Il prezzo onesto è che le riserve sulla risposta geografica si propagano. Un clic instradato attraverso un nodo di uscita in un altro paese porta l'ora di quel paese, e una riga a cui ha risposto il percorso di ripiego porta il fuso orario che ha dichiarato la rete. I grafici per ora locale vanno letti accanto alla ripartizione per rete, per la stessa ragione per cui va letto così il grafico delle città.
Instradare per paese e per lingua
Un solo indirizzo breve, destinazioni diverse: un visitatore dalla Germania atterra sullo store tedesco, un visitatore dal Belgio di lingua francese sulla pagina in francese, tutti gli altri sul sito principale. Le regole di targeting sono un elenco ordinato, le condizioni dentro una regola si uniscono con «e», e vince la prima corrispondenza completa. Ordinare a mano invece che con un punteggio di specificità è uno scambio voluto: un elenco ordinato lo puoi leggere ad alta voce, mentre una tabella di precedenze non è più diagnosticabile appena supera le tre voci.
Il confronto sulle lingue ha una regola che vale la pena imparare a memoria: en copre ogni variante regionale, quindi sia en-GB sia en-US gli corrispondono, mentre en-GB richiede una corrispondenza esatta e non intercetta l'inglese americano. Scrivi la regola ampia quando intendi la lingua e quella specifica quando intendi il mercato.
Un dato mancante non si trasforma mai in un blocco. Se una condizione non è valutabile — il paese è sconosciuto, il pacchetto non era disponibile — la regola semplicemente non corrisponde e il visitatore prosegue verso la destinazione di base. Nelle regole di traffico lo stesso principio è esplicito: ogni condizione ha tre valori, vera, falsa o senza risposta, una regola con una condizione senza risposta viene saltata per intero, e l'inversione lavora solo su dati certi, così «lascia passare soltanto questi paesi» non chiude la porta al mondo quando una consultazione fallisce.
L'ordine della catena è fisso: prima le regole di traffico, perché rispondono a «questa richiesta va servita o no», poi il targeting, poi un eventuale test A/B, poi la destinazione di base. I filtri per paese sulle singole destinazioni del rotatore sono un quarto punto in cui la geografia restringe una scelta: il targeting decide dove va un mercato, il rotatore decide come si ripartisce il traffico di quel mercato.
Instradare non è scambiare i contenuti
La distinzione conta più di quanto sembri. L'instradamento sceglie a quale destinazione reale viene mandata una persona, e ogni destinazione è una pagina che chiunque può aprire e vedere per intero. Scambiare i contenuti significa che un solo indirizzo mostra cose diverse a seconda di chi lo chiede — e la versione di questa pratica a cui i motori di ricerca si oppongono è mostrare a un crawler qualcosa che una persona non vedrebbe mai.
Il redirector non compone e non riscrive le pagine di destinazione; risponde con un reindirizzamento e la destinazione si serve da sola. L'unico caso in cui una richiesta riceve qualcosa di diverso da un reindirizzamento è il crawler delle anteprime social, a cui si risponde con i metadati di anteprima del link stesso, così un link condiviso mostra la stessa card indipendentemente da dove gira il crawler. Quella è un'anteprima, non una pagina sostitutiva.
Le regole possono anche trattare in modo diverso i crawler verificati: lasciarli passare, chiudere il link, mandarli a una pagina segnaposto. La piattaforma ti dà il meccanismo, un'anteprima di quale regola scatterebbe per un dato profilo di visitatore prima ancora che avvenga un clic, e un registro di che cosa è scattato dopo. Se un crawler debba ricevere qualcosa di diverso da quello che riceve una persona è una decisione tua, e il registro è ciò che la rende verificabile.
Tre modi in cui i dati geografici producono errori detti con sicurezza
Leggere un mercato da traffico che in quel mercato non era. Un paese che sale nel tuo grafico non è una prova di domanda finché non hai guardato che cosa lo ha portato. Se la maggior parte dei suoi clic arriva da intervalli di data center o da uscite di VPN commerciali, stai guardando dove sono i nodi di uscita, non dove sono i compratori. È l'errore più costoso della lista perché produce un piano: il budget si sposta, i creativi si localizzano, e niente di tutto questo raggiunge una persona.
Classificare i paesi senza classificare i loro volumi. Un mercato con 90 clic e un tasso di conversione del 4,4 % non sta battendo un mercato con 9.000 clic e il 3,9 %; è un mercato in cui quattro eventi in più sposterebbero il numero più di tutto lo scarto che ti sta entusiasmando. Fissa una soglia minima di volume sotto la quale un paese non entra proprio in classifica, e confronta la differenza osservata con quanto la sposterebbe una manciata di eventi. Il punto non è la purezza statistica, è non riorganizzare un trimestre attorno al rumore.
Fidarsi di una città quando i dati reggono soltanto una regione. Le righe di città portano un raggio, e alcune righe non hanno città del tutto. Una campagna costruita per una singola area metropolitana su righe il cui raggio copre mezzo paese è un piano costruito su un artefatto di arrotondamento. Quando la domanda ha davvero bisogno di una città — l'apertura di un negozio, un evento, una promozione locale — controlla quante delle righe sottostanti portano un identificatore di città e che aspetto hanno i loro raggi prima di impegnarti. Quando non la reggono, usa la regione: è stabile, ancorata a un identificatore e molto più difficile da leggere male.
Una quarta abitudine impedisce ai tre errori di sommarsi: leggi le ripartizioni geografiche accanto alle riserve sulla qualità dei clic descritte nel tracciamento dei clic sui link, e ricorda che i visitatori unici sono una metrica giornaliera — un confronto mensile tra paesi somma gli unici giornalieri invece di contare persone distinte.
Che cosa i dati deliberatamente non contengono
L'indirizzo del visitatore non viene mai memorizzato. Esiste dentro una sola funzione il tempo necessario a produrre un'impronta giornaliera con sale e a consultare l'intervallo di indirizzi, e all'evento non arriva. Il codice postale viene risolto dal database e deliberatamente non registrato, perché in zone edificate fitte un codice postale somiglia troppo a un indirizzo.
Quanto del resto viene memorizzato è un'impostazione dell'area di lavoro, applicata quando l'evento viene scritto e non quando viene letto.
| Livello | Che cosa viene memorizzato | | --- | --- | | Completo | Paese, regione, città, coordinate, raggio di precisione, fuso orario, ora locale | | Città senza coordinate | Paese, regione, città, fuso orario, ora locale | | Solo paese | Paese e continente |
Interruttori separati coprono la rete del visitatore, l'indirizzo di provenienza completo e il rilevamento del tipo di traffico. La conservazione viene scritta dentro ogni evento come un numero di giorni, che è cosa diversa da un piano che limita quanto indietro puoi guardare, e le modifiche raggiungono i link attivi in pochi secondi invece che alla prossima scadenza della cache. I dettagli stanno nelle modalità di privacy e nella guida alla geografia.
C'è un limite in uscita che è facile dare per scontato nel modo sbagliato: la pagina di statistiche pubbliche di un link mostra di tutto questo soltanto paese e città — niente reti, niente tipo di traffico, niente punteggio di qualità, niente coordinate. Quel confine è verificato da un test sulla forma della risposta invece di essere affidato alla convenzione.
Un assetto che regge a un esame attento
- Leggi la ripartizione per rete prima del grafico per paese su qualunque campagna che paghi, confrontando i clic umani con i clic totali provider per provider.
- Fissa un volume minimo di clic sotto il quale un paese non entra in classifica, e mettilo per iscritto perché non venga rinegoziato a ogni riunione.
- Controlla il raggio di precisione prima di qualunque decisione che dipenda da una città, e ripiega sulla regione quando il raggio non la regge.
- Guarda in anteprima che cosa riceverebbe un dato profilo di visitatore prima di pubblicare le regole di targeting, invece di collaudarle in produzione con il tuo traffico.
- Scegli con consapevolezza il livello di dettaglio geografico: decide che cosa viene scritto, e niente di quello che spegni si può recuperare dopo.
- Riconcilia le analytics con i dati lato destinazione una volta per campagna, soprattutto nei mercati in cui i due numeri divergono di più.
I dati di posizione funzionano meglio come due domande invece che una: da dove sembra arrivare la richiesta, e che cosa l'ha portata. La prima da sola produce sempre un grafico; la seconda è ciò che rende quel grafico degno di una decisione. I media buyer ci sbattono contro per primi, ed è per questo che l'assetto per gli affiliati si appoggia agli assi della rete e della qualità più che alla mappa.
Le domande che ci fanno
Quanto sono precisi i dati a livello di città?
Abbastanza precisi per confrontare mercati, non abbastanza per descrivere una persona — e la versione onesta della risposta è un numero, non un aggettivo. Ogni record di città porta un raggio di precisione, e un raggio di decine di chilometri significa che il record descrive un intervallo di indirizzi che un operatore di rete ha assegnato da qualche parte in quell'area. Gli operatori mobili e le reti aziendali collocano abitualmente un visitatore lontano da dove si trova fisicamente, perché l'indirizzo appartiene al punto di uscita e non al telefono. Leggi il raggio prima di leggere il nome della città.
Da dove arriva davvero il paese di un clic?
Da due fonti con ruoli diversi. La rete edge che chiude la richiesta risolve paese, regione, città, coordinate, fuso orario e sistema autonomo senza costi e senza nessuna consultazione, ed è questa la risposta su cui girano le decisioni rapide di instradamento. Un database geografico in licenza risponde con più dettaglio: il raggio di precisione, gli identificatori GeoNames dietro regione e città, nomi stabili in otto lingue e il tipo di proxy dell'intervallo di indirizzi. Ogni riga memorizzata registra quale fonte le ha risposto, così una riga approssimata viene segnalata invece di essere mescolata a quelle precise.
Una VPN rompe le analytics geografiche?
Sposta il visitatore sul nodo di uscita, che è esattamente quello che il visitatore le ha chiesto di fare. La difesa non è una geolocalizzazione migliore ma un secondo asse: la ripartizione per rete etichetta l'intervallo di indirizzi come data center, VPN commerciale, proxy pubblico, uscita TOR o anonimizzatore web, e mostra i clic umani separati dai clic totali. Tratta la quota etichettata come un minimo e non come un censimento: il rilevamento lavora su intervalli noti, e un proxy che gira su normali indirizzi domestici si legge come traffico normale.
Che differenza c'è tra instradare per paese e scambiare i contenuti?
L'instradamento sceglie a quale destinazione reale viene mandato un visitatore; ogni destinazione è una pagina che chiunque può aprire e vedere per intero. Scambiare i contenuti significa che un solo indirizzo mostra contenuti diversi a seconda di chi lo chiede, e diventa un problema di policy quando la versione che riceve un crawler non è quella che riceve una persona. Il redirector non compone e non riscrive mai una pagina di destinazione: risponde con un reindirizzamento e la destinazione si serve da sola. Ai crawler delle anteprime social si risponde con i metadati di anteprima del link stesso, così un link condiviso mostra sempre la stessa card: è un'anteprima, non una pagina diversa.
Perché l'attività per ora locale è diversa dall'attività nel tuo fuso orario?
Perché un report si può disegnare in un solo fuso orario, mentre ogni clic ha il suo. Se converti gli istanti memorizzati nel fuso dell'area di lavoro, un picco serale in tre mercati si spalma in un altopiano. L'ora locale viene quindi calcolata nel momento in cui il clic viene scritto, dal fuso orario risolto per quel visitatore, e conservata sulla riga. Il prezzo di questa scelta è che le riserve sulla risposta geografica si propagano: un clic instradato attraverso una VPN porta l'ora del nodo di uscita, non quella della persona.
Si può limitare il dettaglio geografico per motivi di privacy?
Sì, per area di lavoro, e ha effetto in scrittura invece che in lettura. Il dettaglio completo memorizza paese, regione, città, coordinate, raggio di precisione, fuso orario e ora locale; il livello intermedio tiene la città e rinuncia al punto sulla mappa; «solo paese» tiene continente e paese. Quello che un livello spegne non viene mai scritto, quindi nessun report, nessuna esportazione e nessuna interrogazione futura possono riportarlo indietro. L'indirizzo del visitatore non viene memorizzato a nessun livello, e il codice postale viene risolto durante la consultazione ma deliberatamente mai registrato.