Quién calcula la cifra y con qué datos
SimilarWeb es una empresa privada de análisis de datos digitales, no un servicio de Google ni una fuente oficial de tráfico web. La cifra que muestra para un dominio cualquiera no sale de una conexión directa a la analítica de esa web, salvo en un caso concreto: que el propio dueño del sitio haya autorizado a SimilarWeb a acceder a sus datos. Para el resto, la inmensa mayoría de las webs que se consultan en la herramienta, incluida casi cualquier web de un competidor, la cifra es una estimación construida con otras fuentes.
Según la documentación oficial de SimilarWeb, la empresa combina cuatro tipos de fuente. La primera es la analítica propia que comparten de forma voluntaria millones de webs y apps que sí han conectado sus datos con SimilarWeb: la única fuente que se acerca a una medición real. La segunda es un panel de usuarios, extensiones de navegador y aplicaciones propias instaladas en millones de dispositivos en todo el mundo, que recogen de forma anonimizada el recorrido de navegación de quien las instaló. La tercera es el rastreo de la web pública, con un robot propio que indexa páginas de forma continua. La cuarta son acuerdos de datos con socios externos, entre ellos proveedores de acceso a internet, plataformas de publicidad y empresas de medición, que aportan datos de comportamiento ya agregados sobre webs y apps.
Para una web sin conexión directa, que es el caso habitual cuando se analiza a un competidor, SimilarWeb no mide su tráfico: lo modela a partir de lo que ve en su panel, lo que aportan sus socios de datos y lo que encuentra su rastreador, y extrapola una cifra a partir de ahí. Cuanto mayor sea la presencia de esa web en el panel y en los datos de los socios, más se acerca el modelo a un número fiable. Cuanto menor sea esa presencia, más depende el resultado de la extrapolación estadística en lugar de una observación directa.