ブログに戻る

IPジオロケーション精度:その数字は本当に何を意味するのか

ジオロケーション精度データ品質

国・地域・都市レベルの精度はどう読むべきか。ベンダーの測定方法と、自社トラフィックでジオロケーションデータを検証する実務ポイントを解説します。

# IPジオロケーション精度:その数字は本当に何を意味するのか

IPジオロケーションのベンダーは、たいてい何らかの「精度」を公表しています。ところが、その数字をどのような母集団で、どう測定したのかまで明らかにしているケースは多くありません。数字を鵜呑みにする前に、まず確認すべきなのは「何を対象に測った精度なのか」です。

精度は「ひとつの割合」ではなく「分布」で見る

たとえば「都市レベルで50 km以内の精度」といった表現は、多くの場合、中央値を指しています。実務で問題になるのは、その外側にある裾の部分です。キャリアゲートウェイやクラウドNATの背後にいるために、数百キロ単位で外れる5〜10%のルックアップが、不正対策やリスク判定では痛手になります。

確認すべきは中央値ではなく、90パーセンタイルでどれくらい外れるのかです。

精度はネットワーク種別によって大きく変わる

  • 固定回線の住宅向けブロードバンド: 最も精度が出やすい領域です。ISPは地域ごとにIPアドレスプールを割り当てており、頻繁に移動することもあまりありません。
  • モバイル: 都市レベルの精度は構造的に低くなります。トラフィックが国内の限られたゲートウェイから出ていくためです。
  • ホスティングとクラウド: 示される位置はデータセンターの所在地です。事実としては正しくても、エンドユーザーの行動や居場所を表す情報としてはほとんど意味を持ちません。
  • 企業ネットワーク: 位置情報はオフィスや出口ゲートウェイの所在地になります。従業員が実際にいる場所とは大陸単位で異なることもあります。

これらをひとまとめにした平均的な精度だけを見ても、実態は見えてきません。評価は必ず分類ごとに分けて行うべきです。

自社トラフィックで検証する方法

多くの企業は、すでに正解データに近い情報を持っています。配送先住所、請求先の郵便番号、ユーザーが許可したGPS情報、ブラウザから取得できるタイムゾーンヘッダーなどです。数千セッションをサンプリングし、IPジオロケーションの結果と突き合わせれば、かなり実用的な検証ができます。

  • ユーザーが自発的に位置情報を提供しているセッションを抽出する。
  • そのセッションのIPを照会する。
  • 国の一致、地域の一致、都市については大円距離を記録する。
  • 結果を分類別、ASN別に分解して確認する。

半日もあれば、そのデータセットが自社のユーザー層にとって十分な品質かどうかが見えてきます。結局のところ、重要なのはそこだけです。

ライブAPIがダウンロード型データベースより劣化しにくい理由

IPアドレス空間は常に動いています。ブロックは譲渡され、リースされ、再アナウンスされ、VPN用途から住宅回線用途へ、あるいはその逆へと転用されます。月次でダウンロードするデータベースは、手元に届いた時点ですでに古くなり始めています。

ライブAPIであれば、リクエスト時点でブロックを解決し、再割り当ての変化を数時間単位で反映できます。不正検知ルールが分類情報に依存しているなら、データの古さは単なる誤差ではありません。判定の成否そのものを左右します。

実務で使えるしきい値

  • 国の不一致のみ: ログに残す。ブロックはしない。
  • 国の不一致に加え、ホスティング分類かつ高リスクスコア: 追加認証などのチャレンジを検討する価値がある。
  • 都市の不一致: 分析用途にとどめる。

測定し、分類し、自社データに基づいてしきい値を決める。どんなベンダーのマーケティング文句よりも、そのほうが確かな判断につながります。

現在の接続