Ir al contenido

Glosario Contenido Duplicado

Qué es el contenido duplicado y cómo afecta al posicionamiento SEO

Definición

El contenido duplicado es contenido idéntico o prácticamente idéntico que aparece en más de una URL, dentro de la misma web o entre dominios distintos. Google no aplica por defecto ninguna penalización por esto: elige una versión y consolida ahí las señales de posicionamiento.

Papel carbón sobre dos hojas desplazadas, la de abajo más tenue, junto al título Contenido Duplicado
La copia salió más pálida, pero ocupa sitio igual
En esta página 6
  1. ¿Qué es exactamente el contenido duplicado?
  2. Duplicate Content vs Penalty
  3. Las causas más frecuentes de contenido duplicado
  4. Cómo solucionarlo: canonical, redirect 301 o noindex
  5. Buenas prácticas
  6. Errores frecuentes
En breve

Tener las mismas frases en dos URLs no hunde una web por sí solo. El problema aparece cuando Google no sabe qué versión mostrar en resultados y reparte el valor SEO entre varias copias en lugar de concentrarlo en una sola.

Papel carbón sobre dos hojas desplazadas, la de abajo más tenue, junto al título Contenido Duplicado
La copia salió más pálida, pero ocupa sitio igual

¿Qué es exactamente el contenido duplicado?

Se habla de contenido duplicado cuando un mismo bloque de texto, o una versión casi calcada, es accesible desde varias URLs distintas. Puede pasar dentro de una misma web, con dos rutas que llevan al mismo producto, o entre dominios diferentes, con un artículo republicado sin cambios en otro sitio. Google rastrea e indexa por URL, no por contenido: cada dirección que devuelve el mismo texto es, técnicamente, una página nueva que hay que procesar, comparar y clasificar.

El duplicado exacto es el caso más fácil de detectar. La misma página cargada con y sin parámetros de seguimiento, con y sin barra final, en http y en https, con www y sin www. El HTML apenas cambia entre versiones; solo cambia la dirección. Suele ser un efecto secundario técnico, no una decisión editorial, y casi siempre se soluciona con una sola herramienta: canonical o redirect.

El contenido casi duplicado, o near duplicate, es harina de otro costal. El texto no es idéntico, pero se parece tanto que aporta poco valor adicional: la ficha de una camiseta en talla S y la misma ficha en talla M con dos palabras cambiadas, un comunicado de prensa sindicado en diez portales con el mismo cuerpo de texto, una versión imprimible de un artículo, o una landing traducida a medias entre España y México sin marcar la relación entre ambas versiones con hreflang. Este es, con diferencia, el caso más habitual en la práctica. Casi ninguna web tiene contenido duplicado exacto a propósito, pero casi todas las webs de cierto tamaño acumulan variantes casi duplicadas sin darse cuenta.

En ambos casos el efecto práctico es parecido. Google suele quedarse con una sola versión para mostrar en resultados y trata las demás como copias secundarias que no compiten por su cuenta. El sitio no pierde autoridad por tener las copias, pero tampoco gana nada manteniéndolas separadas si podría concentrar esa autoridad en una sola URL. Y hay un coste indirecto: rastrear, comparar y descartar páginas duplicadas consume presupuesto de rastreo que Google podría dedicar a contenido nuevo o relevante del mismo sitio.

Duplicate Content vs Penalty

Aquí está el mito más repetido del SEO en español: que Google "penaliza" el contenido duplicado con un castigo algorítmico automático. No es así, y Google lo dice de forma explícita en su documentación oficial de Search Central. Si no se específica una URL canónica, el buscador identifica cuál es, en sus propias palabras, "la versión objetivamente mejor" para mostrar a los usuarios, y consolida ahí las señales de las demás copias.

Lo que pasa realmenteEl mito extendido
Google agrupa las URLs duplicadas y elige una versión canónica para mostrar en resultadosGoogle aplica una penalización algorítmica a cada página duplicada
Los enlaces y señales de las copias se consolidan en la versión canónica elegidaTener contenido duplicado "resta puntos" a la autoridad de todo el dominio
Las copias no elegidas simplemente no suelen posicionar por separadoCada URL duplicada cuenta como una infracción individual y acumulativa
Una acción manual por contenido duplicado es poco frecuente y se reserva para scraping o content spinning con intención de manipular el rankingCualquier página parecida puede acarrear una sanción manual de un día para otro

La excepción real está en las políticas de spam de Google, no en el contenido duplicado como tal. Republicar contenido ajeno a gran escala, con técnicas automatizadas y sin aportar valor propio, sí puede derivar en una acción manual o en que esas páginas dejen de aparecer en resultados. La diferencia es la intención: duplicar sin querer, por cómo está montada la web, no es lo mismo que copiar contenido de terceros para manipular el posicionamiento.

Las causas más frecuentes de contenido duplicado

Cuatro causas explican la mayoría de los casos que aparecen en una auditoría técnica.

La primera son los parámetros de URL. Un mismo parámetro GET puede generar decenas de variantes de la misma página: filtros de una tienda online, parámetros de orden, códigos de campaña UTM o identificadores de sesión. La página es la misma, pero para un rastreador cada combinación de parámetros es una URL distinta que hay que evaluar.

La segunda es la sindicación de contenido: publicar el mismo artículo, comunicado o ficha de producto en varios sitios sin coordinar cuál es la fuente original. Es habitual en marketplaces que replican descripciones de fabricante tal cual, y en medios que redistribuyen notas de prensa sin reescribirlas.

La tercera son las variantes de producto en e-commerce y la navegación por filtros: la misma camiseta en cinco colores y tres tallas, cada una con su propia URL y una descripción que cambia solo en una palabra, o un listado de categoría que genera una URL distinta por cada combinación de filtro de precio, marca y talla aplicada.

La cuarta son los duplicados internacionales sin hreflang: la misma página, traducida o casi idéntica, para distintos mercados de habla hispana o inglesa, sin la etiqueta que le indica a Google que cada versión sirve a un país o idioma diferente y no es una copia de otra.

El caso más común en la práctica es el primero: la misma ficha de producto accesible con y sin parámetros de tracking. Así se ve con un ejemplo real usando una URL de zds.es:

<!-- Versión 1: URL limpia -->
https://zds.es/tienda/zapatillas-running

<!-- Versión 2: misma página, con parámetros de una newsletter -->
https://zds.es/tienda/zapatillas-running?utm_source=newsletter&utm_campaign=verano2026

<!-- Ambas versiones deben incluir el mismo canonical en el <head> -->
<link rel="canonical" href="https://zds.es/tienda/zapatillas-running" />

Las dos URLs sirven exactamente el mismo HTML. Sin el canonical, Google podría indexar ambas por separado, repartir enlaces entrantes entre las dos y, en el peor caso, mostrar en resultados la versión con parámetros en lugar de la limpia. Con el <link rel="canonical"> apuntando siempre a la URL sin parámetros, todas las variantes consolidan sus señales ahí, se genere el tráfico desde donde se genere.

Dos URLs, un contenido — sin canonical y con canonical

Cómo solucionarlo: canonical, redirect 301 o noindex

El canonical es la herramienta principal contra el contenido duplicado, y con razón: es una sugerencia fuerte a Google sobre cuál es la versión de referencia, sin eliminar el acceso a las demás. Es la opción correcta cuando las URLs duplicadas necesitan seguir existiendo, por ejemplo porque reciben tráfico de campañas, de filtros de usuario o de integraciones externas que no se pueden eliminar sin más.

El redirect 301 es preferible cuando la URL duplicada no tiene ninguna razón para seguir existiendo: una migración de http a https, un cambio de www a sin-www, o una reestructuración donde la ruta antigua queda obsoleta. Aquí no tiene sentido mantener dos versiones vivas ni pedirle a Google que elija entre ellas; se redirige y todo el valor de los enlaces entrantes pasa directamente a la nueva URL.

El noindex se reserva para páginas que existen por necesidad técnica o de usuario, pero que no aportan nada a la búsqueda: resultados de búsqueda interna, combinaciones de filtro muy específicas, versiones imprimibles o páginas generadas automáticamente con poco contenido propio. A diferencia del canonical, el noindex saca la página del índice directamente en lugar de consolidar sus señales en otra URL. Mezclar canonical y noindex en la misma página, dando dos instrucciones contradictorias a la vez, es uno de los errores más comunes en auditorías reales.

Para la sindicación entre dominios distintos, la solución depende de si se controla el sitio que republica. Si es un partner con el que hay relación, lo correcto es pedirle que añada un canonical hacia la fuente original o que marque su copia con noindex. Si es un sitio que copia sin permiso, el canonical no sirve de nada porque no se puede editar esa página ajena; ahí la vía es la denuncia por infracción de derechos de autor, no una etiqueta técnica.

Buenas prácticas

  • Usar canonical autorreferenciado: la propia versión canónica debe apuntarse a sí misma en su etiqueta <link rel="canonical">.
  • Mantener el sitemap.xml solo con URLs canónicas, nunca con variantes que llevan parámetros o identificadores de sesión.
  • Enlazar internamente siempre a la versión canónica y no a variantes con parámetros; conviene revisar el enlazado interno del sitio con cierta frecuencia.
  • Añadir hreflang cuando el contenido es realmente distinto por país o idioma, nunca como sustituto del canonical.
  • Pedir a los partners de sindicación que apunten su copia con canonical hacia la fuente original, o que la marquen con noindex.
  • Rastrear el propio sitio con un crawler como Screaming Frog para detectar URLs que devuelven contenido idéntico antes de que el problema llegue a producción.

Errores frecuentes

  • Canonical que apunta a una página distinta o irrelevante, rompiendo la relación real entre ambas versiones.
  • Cadenas de canonical: la página A apunta a B, y B apunta a C, en vez de apuntar todas directamente a la versión final.
  • Bloquear por robots.txt una URL que lleva un canonical hacia otra: si Googlebot no puede rastrearla, tampoco puede leer esa etiqueta.
  • Combinar canonical y noindex en la misma URL, enviando dos señales contradictorias al mismo tiempo.
  • Usar canonical para "esconder" contenido que en realidad debería ser único y estar indexado por sí mismo.
  • Confundir contenido duplicado con contenido similar por temática: dos artículos que tratan el mismo tema con enfoques distintos no son duplicados, son contenido relacionado y ambos pueden posicionar.
Manuel Riveiro Rodriguez CEO & Digital Strategist

Una auditoría técnica revisa esto y el resto en un solo paso.

Solicitar auditoría

Preguntas frecuentes

¿El contenido duplicado penaliza mi web en Google?

No de forma automática. Google consolida las señales en una versión canónica y suele mostrar solo esa en resultados. Una acción manual por contenido duplicado es rara y se limita a casos de scraping o content spinning con intención de manipular el ranking.

¿Cuál es la diferencia entre contenido duplicado exacto y near duplicate?

El exacto es la misma página accesible desde varias URLs, con o sin parámetros, con o sin www. El near duplicate es contenido distinto pero muy parecido, como variantes de producto, versiones sindicadas o traducciones a medio hacer entre mercados.

¿Basta con un canonical para arreglar el duplicado entre www y sin www?

Funciona, pero un redirect 301 es mejor en ese caso concreto. La versión antigua no tiene motivo para seguir siendo accesible, así que conviene redirigir en lugar de mantener las dos URLs vivas con un canonical entre ellas.

¿Necesito canonical si ya tengo hreflang bien configurado?

No para esas páginas. El hreflang le dice a Google que esas versiones son legítimamente distintas por idioma o país, no copias que haya que consolidar en una sola URL.

¿Puede una herramienta de rastreo detectar el contenido duplicado antes de publicarlo?

Sí. Un crawler como Screaming Frog compara el contenido entre URLs y señala coincidencias exactas o muy altas antes de que el problema llegue a producción, lo que permite corregirlo antes de que Google lo indexe.

Fuentes

  1. Google Search Central: Consolidar URLs duplicadas: documentación oficial que confirma que Google no aplica una penalización por contenido duplicado, sino que consolida las señales en la versión que considera más adecuada para mostrar. Actualizado el 10.07.2026.
  2. Google Search Central: Políticas de spam para Búsqueda: define el scraping de contenido como práctica manipuladora que sí puede derivar en una acción manual, a diferencia del contenido duplicado ordinario. Actualizado el 15.05.2026.