Ir al contenido

Glosario Página Huérfana

Qué es una Orphan Page (página huérfana) y cómo encontrarla

Definición

Una orphan page (página huérfana) es una página que existe en un dominio, es técnicamente accesible y puede incluso estar indexada, pero a la que ninguna otra página del mismo sitio enlaza. No aparece en el menú, no tiene breadcrumb que la sitúe en la jerarquía y ningún artículo o categoría la menciona con un enlace. La única vía de entrada es una URL directa, un enlace externo o, si Google la conoce, un resultado de búsqueda.

Una casita de piedra sola en un campo, sin ningún camino que llegue, junto al título Página Huérfana
La casa está en pie y no llega ningún camino
En esta página 6
  1. Por qué una página huérfana es un problema aunque esté indexada
  2. Página huérfana frente a otros problemas parecidos: error 404, noindex y contenido escaso
  3. Causas típicas de las páginas huérfanas
  4. Cómo encontrar páginas huérfanas
  5. Buenas prácticas
  6. Errores comunes
En breve

Una página huérfana no recibe enlaces internos desde ninguna otra página del dominio. Puede estar indexada porque los buscadores la descubrieron por la sitemap.xml, pero sin enlaces internos no recibe flujo de autoridad y ningún usuario llega a ella navegando el sitio. El problema real está en la arquitectura, no en el rastreo. Se detecta comparando las URLs de la sitemap contra las URLs realmente enlazadas en un crawl, y se corrige enlazándola desde páginas relevantes o eliminándola si ya no aporta valor.

Una casita de piedra sola en un campo, sin ningún camino que llegue, junto al título Página Huérfana
La casa está en pie y no llega ningún camino

Por qué una página huérfana es un problema aunque esté indexada

No existe una definición oficial de «página huérfana» por parte de Google ni de ningún organismo de normalización; el término se ha consolidado como vocabulario de la práctica en SEO, popularizado por herramientas de rastreo como Screaming Frog, Ahrefs o Sitebulb.

=================================================== Es fácil asumir que si una página aparece en Google Search Console como indexada, está "bien". No es así. La indexación y la interconexión interna son dos procesos distintos, y confundirlos es el error de base detrás de la mayoría de páginas huérfanas que nadie detecta a tiempo.

Google puede rastrear e indexar una URL que aparece en el sitemap.xml sin que ninguna otra página del sitio la mencione. El rastreador la visita, la procesa y la añade al índice. Hasta ahí, todo parece correcto. El problema aparece en dos frentes que no se ven en un informe de cobertura básico.

El primero es el flujo de PageRank interno. Los enlaces entre páginas de un mismo dominio transmiten autoridad de unas a otras. Una página sin enlaces entrantes internos no recibe nada de esa autoridad, por muy fuerte que sea el dominio en su conjunto. Compite en los resultados con una fracción de la fuerza que debería tener, incluso si el contenido es bueno.

El segundo es la experiencia real de navegación. Ningún usuario llega a una página huérfana haciendo clic dentro del sitio, porque no hay ningún clic posible que lleve hasta ella. Solo la alcanza quien entra por una búsqueda directa, un enlace externo o quien conoce la URL de memoria. Para el resto de visitantes, esa página no existe, aunque el servidor la sirva sin errores.

Por eso conviene separar dos conceptos que se mezclan con frecuencia: visibilidad e indexación no son sinónimos. Una página puede estar indexada y a la vez ser invisible para cualquiera que navegue el sitio de forma normal. Rastreo, indexación y descubribilidad interna son tres capas distintas, y una página huérfana falla específicamente en la tercera.

Hay además un efecto de señal a medio plazo. Los motores de búsqueda interpretan la posición de una página dentro de la arquitectura del sitio como parte del contexto que usan para entender su relevancia temática. Una página aislada, sin enlaces entrantes ni salientes hacia contenido relacionado, transmite menos contexto sobre de qué trata y a qué otras páginas del dominio pertenece. Con el tiempo, eso puede traducirse en menos rastreos de refresco, porque el propio rastreador prioriza URLs que forman parte activa del grafo de enlaces del sitio.

===================================================

Indexada y aun así inalcanzable

Página huérfana frente a otros problemas parecidos: error 404, noindex y contenido escaso

=================================================== Conviene distinguir la página huérfana de otros tres problemas con los que se confunde a menudo, porque cada uno se diagnostica y se corrige de forma distinta.

Frente al error 404, la diferencia es de existencia: un 404 responde que el recurso ya no está ahí, mientras que una página huérfana existe, responde con normalidad y a menudo con un código 200. El fallo no está en el servidor: nada del propio sitio apunta hacia ella.

Frente a una página con etiqueta noindex, la diferencia es de intención. El noindex es una exclusión deliberada: alguien decidió que esa URL no debía aparecer en los resultados de búsqueda. La página huérfana, en cambio, suele ser un descuido: nadie decidió aislarla, simplemente dejó de estar enlazada tras un cambio en el sitio.

Frente al contenido escaso (thin content), la diferencia es de naturaleza del problema. El contenido escaso es un fallo de calidad o profundidad del texto; la página huérfana es un fallo estructural de enlazado. Una página puede sufrir ambos problemas a la vez, uno no implica el otro, y arreglar uno no soluciona el otro.

===================================================

Causas típicas de las páginas huérfanas

=================================================== Las páginas huérfanas casi nunca se crean a propósito. Aparecen como efecto secundario de decisiones tomadas en otra parte del sitio, y por eso son tan difíciles de detectar sin un proceso específico para buscarlas.

La causa más común es un rediseño de la navegación. Cuando se reestructura un menú, una categoría o un footer, es habitual que ciertas entradas se eliminen porque parecían poco relevantes o duplicadas. La URL sigue online, sigue funcionando, pero deja de estar enlazada desde cualquier punto del sitio.

Otra causa frecuente son las páginas de resumen o categoría mantenidas a mano. Bajo un glosario con varias decenas de fichas de términos, por ejemplo, puede pasar fácilmente que se cree una página nueva y no se actualice la página índice que la debería listar, porque esa actualización depende de que alguien recuerde hacerla manualmente. La ficha nueva existe, es accesible por URL directa e incluso puede estar en el sitemap, pero ninguna otra página del dominio la menciona: es justo el tipo de causa que produce una orphan page sin que nadie lo note hasta que se audita.

Las landing pages de campaña son otra fuente habitual. Se crean para una promoción concreta, se enlazan desde banners, newsletters o anuncios durante un periodo limitado y, cuando la campaña termina, se retiran los enlaces internos que apuntaban a ellas. La página sigue publicada, a veces indexada durante meses, pero ya no forma parte de ningún recorrido de navegación real.

Las migraciones de URL también generan huérfanas cuando cambia la estructura de carpetas o el sistema de gestión de contenidos. Si el proceso de migración no revisa sistemáticamente qué páginas antiguas seguían recibiendo enlaces internos, algunas quedan aisladas sin que nadie lo planeara.

===================================================

Cómo encontrar páginas huérfanas

=================================================== Detectar páginas huérfanas requiere cruzar dos fuentes de datos que casi nunca coinciden por completo: la lista de URLs que el sitio dice tener (la sitemap.xml) y la lista de URLs que un rastreo real consigue alcanzar siguiendo enlaces desde la home.

El método estándar es rastrear el sitio con una herramienta como Screaming Frog en modo "list" usando la sitemap.xml como fuente de URLs, y en paralelo rastrear el sitio en modo normal siguiendo únicamente enlaces internos. Screaming Frog incluye un informe específico de "Orphan Pages" que compara ambos conjuntos: las URLs que aparecen en la sitemap, en Google Search Console o en Google Analytics, pero que el crawler normal, siguiendo solo enlaces, nunca llega a encontrar.

Para que ese informe sea fiable conviene conectar Screaming Frog a Google Search Console y a Google Analytics antes de lanzar el rastreo, porque cruza tres fuentes: las URLs enlazadas internamente, las URLs indexadas según GSC y las URLs que reciben tráfico según Analytics. Una URL que aparece en las dos últimas fuentes pero no en la primera es, con alta probabilidad, una página huérfana.

En sitios grandes conviene repetir este cruce con regularidad, no solo una vez. Cada publicación nueva, cada rediseño de menú y cada migración parcial puede generar huérfanas distintas a las de la última auditoría, así que tratarlo como una comprobación puntual en lugar de un proceso recurrente deja pasar casos nuevos sin que nadie se entere hasta meses después.

También sirve como comprobación manual revisar el informe de cobertura de Google Search Console y filtrar por URLs indexadas, para después comprobar una por una si son alcanzables navegando el sitio con normalidad desde la home, sin usar la barra de direcciones. Es un proceso más lento, pero útil en sitios pequeños donde no compensa configurar una herramienta de rastreo completa.

===================================================

Buenas prácticas

===================================================
  • Enlazar toda página nueva desde al menos una página de categoría, hub o artículo relacionado antes o justo después de publicarla, nunca semanas después.
  • Auditar periódicamente con Screaming Frog (informe de Orphan Pages) cruzado con Search Console y Analytics, no solo una vez al lanzar el sitio.
  • Mantener actualizadas las páginas índice o de categoría cada vez que se publica contenido nuevo dentro de esa sección.
  • Añadir módulos de "artículos relacionados" o enlazado contextual dentro del propio contenido, no solo en menús y footers.
  • Revisar el enlazado interno como paso obligatorio dentro de cualquier proceso de rediseño de navegación, antes de eliminar entradas de menú.
  • Incluir breadcrumbs que sitúen cada página dentro de la jerarquía del sitio y añadan, de paso, un enlace interno adicional.
===================================================

Errores comunes

===================================================
  • Confiar en que estar presente en la sitemap.xml basta para que una página funcione bien en SEO.
  • Eliminar entradas del menú durante un rediseño sin comprobar antes qué páginas quedan sin ningún enlace interno alternativo.
  • Dar por buena una página solo porque Google Search Console la marca como indexada.
  • Dejar landing pages de campaña publicadas y enlazadas solo desde canales externos temporales, sin retirarlas ni integrarlas en la navegación permanente.
  • No revisar el enlazado interno tras una migración de URLs o un cambio de gestor de contenidos.
===================================================
Manuel Riveiro Rodriguez CEO & Digital Strategist

Una auditoría técnica revisa esto y el resto en un solo paso.

Solicitar auditoría

Preguntas frecuentes

¿Una página huérfana puede seguir apareciendo en Google?

Sí. Si Google la descubrió a través de la sitemap.xml o de un enlace externo, puede rastrearla e indexarla aunque ningún otro contenido del propio dominio la enlace. Estar indexada no significa que reciba autoridad interna ni que un usuario pueda llegar a ella navegando el sitio.

¿Es lo mismo una página huérfana que una página con noindex?

No. El noindex es una decisión deliberada de excluir una URL de los resultados de búsqueda. La página huérfana normalmente no fue excluida a propósito: simplemente dejó de estar enlazada desde el resto del sitio, casi siempre por descuido.

¿Cómo sé si una página de mi sitio es huérfana sin usar herramientas de pago?

Se puede revisar el informe de cobertura de Google Search Console, filtrar las URLs indexadas y comprobar manualmente, navegando desde la home sin escribir la URL directamente, si cada una es alcanzable a través de algún enlace del sitio. Screaming Frog también ofrece una versión gratuita limitada con el informe de Orphan Pages.

¿Todas las páginas huérfanas hay que enlazarlas?

No necesariamente. Si la página ya no aporta valor, la opción correcta suele ser eliminarla o redirigirla con un 301 hacia contenido vigente. Enlazar solo tiene sentido cuando el contenido sigue siendo relevante y merece formar parte de la arquitectura del sitio.

¿Las páginas huérfanas afectan al crawl budget?

De forma indirecta. No es el problema principal en sitios pequeños, pero en dominios grandes, si Googlebot dedica rastreo a URLs aisladas que nadie enlaza ni actualiza, ese rastreo se resta del que podría dedicarse a páginas realmente prioritarias.