トラフィックルール
すべてのクリックが、あなたのランディングページに値するわけではありません
短縮リンクは1枚の扉であり、いまはその扉が誰にでも開いています。費用を払って獲得した購入者にも、競合の価格表を作るスクレイパーにも、他人のレポートを水増しするクリックファームにも。トラフィックルールは、その扉に条件を付けます——1本のリンクにつき最大20件の順序付きルールを、リダイレクト先が選ばれる前にエッジで評価し、ルールが1つもないリンクには余分な問い合わせを一切加えません。
条件は推測ではなく、訪問者そのものを記述する
すべてのルールは「かつ」で結ばれた条件の集まりで、最初に一致したルールが結果を決めます。条件は、実際にあなたが頭の中で考えるとおりのものです。訪問者がどの国、地域、都市にいるか。自律システム番号で見て、どのネットワークから来たか。そのネットワークがデータセンターか、商用VPNか、公開プロキシか、TORの出口ノードか、Web匿名化サービスか。訪問者分類器がその訪問者について何と判断し、どれだけ低く採点したか。名乗っているクローラーが本物かどうか。デバイス、言語、参照元ページ、ユーザーエージェントのパターン、キャンペーンタグの有無、現地の時間帯、曜日、そして初回の訪問か再訪かです。
このうち2つには注記の価値があります。競合が提供できないのが、まさにこの2つだからです。ネットワークの種別は、ユーザーエージェントのブロックリストではなく、アドレス範囲を鍵にしたプロキシデータベースから得られます。だからChromeを名乗るスクレイパーも、変わらずデータセンターとして見抜かれます。そして「検証済みクローラー」は、名前の確認ではなくアドレスの確認です。家庭向けISPからGooglebotを名乗ってくるリクエストはGooglebotではなく、ルールエンジンはその違いを見分けます。
条件が3値なのは意図的です。条件は、満たされるか、満たされないか、データがなくて答えられないかのいずれかになります——そして「答えられない」が一致として数えられることはありません。条件の反転は、確信のある答えだけを裏返します。だから「ドイツ以外の全員」と書いたルールが、国を特定できなかった訪問者に対して黙って発動することはありません。
- 分類器による訪問者の種別、真正性の検証、品質スコア
- ネットワークの種別——データセンター、VPN、公開プロキシ、TOR、Webプロキシ
- 国、地域、都市、自律システム番号、アドレスまたはサブネット
- デバイス、言語、参照元、ユーザーエージェントのパターン、キャンペーンタグ
- 現地時刻の時間帯、曜日、初回の訪問と再訪の区別
- 再利用できるアドレスリスト——1つのリストを多数のルールから参照
5つの結果、そのどれも行き止まりではない
一致したルールは、訪問をそのまま通して一致した事実だけを記録することも、404または410でリンクを利用不可として返すことも、その訪問者を別のリンク先へ送ることも、独自の文言を載せたブランド適用済みのスタブページを表示することも、行き先を変えずに訪問を疑わしいものとして印を付けることもできます。
「通して記録する」という動作があるのは、監査できないフィルターは信頼できないフィルターだからです。一致はすべて、ルールの識別子と実行された動作とともにクリックイベントに書き込まれます。だから「フィルター済み」の内訳が、「このルールはどれだけのトラフィックを止めたのか、そして止めるべきトラフィックを止めたのか」に答えられます——その後に編集したり削除したりしたルールについても同じです。動作が識別子と並べて保存されているからです。
404での遮断が、あえて通常の「見つかりません」ページを返すのには理由があります。遮断されたリンクは、最初から存在しなかったリンクと見分けが付いてはいけません。そうでなければ、あなたのリンクを探っている相手に、探る価値のあるものを見つけたと教えることになります。
1本のリンクのルールと、ワークスペース全体のルール
方針のほとんどは、1本のリンクの話ではありません。ワークスペース全体のルールセットは、そのクライアントが持つすべてのリンクに適用され、リンク自身のルールの後に評価されます。だから1本のリンクが、全体の禁止の上に例外を載せられます——ワークスペースの階層では「データセンターからはすべて遮断」、監視対象の1本のリンクでは「自社の監視だけは通す」というように。共有のルールセットから完全に外れることも、リンクごとに選べます。
ルールを本番に出す前に、仮想の訪問者——国、デバイス、ネットワークの種別、時刻——に対して試し、どのルールが発動して訪問者がどこに着地するかを正確に確認できます。このプレビューは作り直した別実装ではありません。エッジのワーカーが呼ぶのと同じ純粋関数を呼び、その答えを実際のリダイレクトの実際のLocationヘッダーと突き合わせるエンドツーエンドのテストがあります。
ルールのコストは後付けの心配ごとではなく、設計上の制約
フィルタリングはリダイレクトへ向かう経路の上で行われます。そこは、ミリ秒が人間の目に見える唯一の場所です。そのためエンジンは、そのリンクのルールが実際に必要とするデータだけを要求します。国の条件は地理情報の参照を発生させ、プロキシ種別の条件はアドレス範囲の集合を読み込み、検証済みクローラーの条件はキャッシュのエントリーを読みます。ルールのないリンクは、追加の読み取りを1回も行いません——これは期待ではなく、呼び出し回数を数えるテストで保証されています。
ルールが取得したものは、クリックイベントを組み立てるバックグラウンドの処理にそのまま引き渡されるので、同じ参照の代金を二度払うことはありません。
よくある質問
フィルタリングでリダイレクトは遅くなりますか?
ルールのないリンクには何の影響もありません。追加の問い合わせはまったく発生しません。ルールのあるリンクも、その条件が必要とするものだけを取得し、参照先は遠くのデータベースではなく、エッジのために作られたデータ構造です。ルールの評価そのものは、すでに取得済みの値に対する純粋関数です。
遮断したトラフィックはどうなりますか。レポートから消えてしまいますか?
消えません。遮断された訪問も、ルールの識別子と動作を添えてクリックイベントとして記録され、「フィルター済み」の内訳に表示されます。訪問者には404か410、あるいはあなたのスタブページが返り、あなたにはフィルターが効いているという証拠が残ります。
IPアドレスで絞り込めますか?
絞り込めます。個別のアドレスでも、サブネットでも、1つのリストにつき最大1000件まで登録できます。リストは再利用できます。「社内ネットワーク」を一度定義すれば、好きなだけ多くのルールから参照できます。リダイレクターがリクエストの時点でリストを取りに行くことはありません。リストは保存の時点で、そのリンクのキャッシュ済み設定に展開されます。
これはボット検知と同じものですか?
ボット検知は入力の1つです。どんな訪問者なのかを判断するのが分類器で、それに対してどうするかを決めるのがトラフィックルールです。データセンターだけを遮断して検証済みの検索クローラーは通すことも、質の低いトラフィックを頭ごなしに遮断せずスタブページへ振り分けることもできます。
あなたのブランドのリンク短縮サービスを立ち上げる
ドメインを接続し、価格を公開し、最初の顧客を招待する——多くのパートナーは一晩で公開まで進みます。
トライアルにカードは不要です。