Volver al blog

Precisión de la geolocalización IP: qué significan de verdad las cifras

geolocalizaciónprecisióncalidad de datos

Qué indican las tasas de precisión por país, región y ciudad, cómo las calculan los proveedores y cómo validar un conjunto de datos de geolocalización con tu propio tráfico.

# Precisión de la geolocalización IP: qué significan de verdad las cifras

Todos los proveedores presumen de una cifra de precisión. Lo que casi nadie publica es la metodología que hay detrás. Antes de dar por buena una métrica, conviene hacerse una pregunta clave: ¿sobre qué población se ha medido?

La precisión es una distribución, no un porcentaje

Una afirmación como "precisión a nivel de ciudad en un radio de 50 km" suele referirse a una mediana. Pero el problema está en la cola de la distribución: ese 5-10% de consultas que se desvían cientos de kilómetros porque pasan por una pasarela de operador o por un NAT en la nube. No te quedes solo con la mediana: pide el error en el percentil 90.

La precisión cambia muchísimo según el tipo de red

  • Banda ancha residencial fija: el mejor escenario. Los ISP asignan rangos por zonas y rara vez los mueven.
  • Móvil: poca precisión a nivel de ciudad por diseño. El tráfico sale por un número reducido de pasarelas nacionales.
  • Hosting y cloud: la ubicación es la del centro de datos; técnicamente es correcta, pero no dice nada útil sobre el usuario final.
  • Corporativo: la ubicación corresponde al punto de salida de la oficina, que puede estar en otro continente distinto al del empleado.

Una única cifra agregada de precisión esconde todos estos matices. Segmenta la evaluación por clasificación.

Cómo validarlo con tu propio tráfico

Probablemente ya tienes la fuente de verdad: direcciones de envío, códigos postales de facturación, permisos GPS o cabeceras de zona horaria del navegador. Basta con tomar una muestra de unos cuantos miles de sesiones y comparar.

  • Selecciona sesiones en las que el usuario haya facilitado voluntariamente una ubicación.
  • Consulta la IP de la sesión.
  • Registra la coincidencia por país, la coincidencia por región y la distancia ortodrómica para la ciudad.
  • Desglosa los resultados por clasificación y por ASN.

En una tarde puedes saber si ese conjunto de datos es suficientemente bueno para tu audiencia concreta, que al final es la única pregunta que importa.

Por qué las API en vivo envejecen mejor que las bases de datos descargables

El espacio de direcciones cambia constantemente. Los bloques se transfieren, se alquilan, se vuelven a anunciar y pasan de usos VPN a residenciales, o al revés. Una base de datos que descargas una vez al mes empieza a quedarse obsoleta desde el momento en que llega a tus sistemas. Una API en vivo resuelve el bloque en el momento de la consulta y refleja las reasignaciones en cuestión de horas. Si tus reglas antifraude dependen de la clasificación, la obsolescencia no es un pequeño desajuste: es el centro del problema.

Umbrales prácticos

  • Diferencia de país sin más: registrar, nunca bloquear.
  • Diferencia de país más clasificación de hosting más puntuación de riesgo alta: merece un challenge.
  • Diferencia de ciudad: solo para analítica.

Mide, segmenta y define umbrales a partir de tus propios datos. Eso vale más que cualquier promesa comercial de un proveedor.

Su conexión