Saltar al contenido

Duplicate Content

El mismo contenido accesible bajo varias direcciones

Cuando un texto idéntico o casi idéntico es accesible bajo varias direcciones — no hay sanción por eso, sino una selección que hace el propio Google.

  1. Un contenido acaba bajo varias direcciones
  2. Google filtra en vez de sancionar
  3. Se elige una dirección como principal
  4. El prestigio se concentra si las señales coinciden

¿Qué significa Duplicate Content?

El duplicate content surge casi siempre sin querer: la misma página con y sin www, con un número de sesión de una campaña, como versión para imprimir, como vista filtrada en una tienda, o porque un texto está a la vez en una entrada de blog y en una página de resumen temático. De un único contenido resultan así varias direcciones que a las personas les parecen iguales y que, para un buscador, en un primer momento parecen varias páginas distintas.

En torno al término se ha instalado un malentendido persistente: la idea de una «sanción por duplicate content» que penaliza activamente una web por tener contenido duplicado. Google lo desmiente expresamente en su propia documentación — no existe tal sanción en el sentido habitual. Lo que ocurre en su lugar Google lo llama filtrado o canonicalización: de varias direcciones equivalentes se elige una para los resultados, las demás quedan relegadas, no sancionadas.

Esta selección la hace el buscador de forma algorítmica a partir de señales — enlazado interno, redirecciones, entradas en el directorio de direcciones y la etiqueta canonical, que sirve como indicación de qué dirección debe ser la principal. Google suele seguir esta indicación, pero no siempre. Con señales contradictorias puede elegirse una dirección distinta de la deseada, sin que ningún mensaje de error lo advierta.

El daño real no está en una penalización, sino en la dispersión: si media web enlaza a la variante con www y la otra mitad a la variante sin www, el prestigio que una página ha acumulado se reparte entre dos direcciones en lugar de concentrarse en una. Además, el buscador desperdicia capacidad de rastreo en variantes que al final no se van a mostrar de todos modos.

Hay una excepción que contribuye a la confusión: en la copia masiva de contenido ajeno a través de muchos dominios, por ejemplo en redes de spam, Google sí puede intervenir — pero eso ocurre a través de las directrices contra el spam, no mediante una regla propia de duplicate content. El caso habitual en la propia web, del que trata este apartado, es distinto de eso y bastante más inofensivo.

Para la práctica esto significa: fijar una variante de dirección (con o sin www, con o sin barra final), reflejar esa decisión de forma consistente en la etiqueta canonical, llevar los contenidos realmente trasladados mediante una redirección y no mediante una simple indicación, y no publicar el mismo texto dos veces en la misma web sin necesidad. Los detalles sobre la implementación técnica de la indicación están en la entrada sobre la etiqueta canonical; aquí lo que cuenta sobre todo es la regla de fondo.

Para comprobar las cifras

Para este apartado no damos deliberadamente ninguna cifra — no hay un «valor de sanción» medible que pudiéramos aportar, porque la sanción en sí no existe.

Lo que sí se puede demostrar aquí no es una cifra, sino una afirmación: Google aclara en su propia documentación que «en la mayoría de los casos» no hay sanción por duplicate content, sino un filtrado automático. Inventar una cifra al respecto, por ejemplo una supuesta pérdida de posicionamiento en porcentaje, sería exactamente el tipo de afirmación frente a la que queremos advertir aquí. Lo que sí se puede medir es el caso concreto — qué dirección ha elegido realmente Google se ve en Google Search Console.

Fuente: Google Search Central, documentación sobre contenido duplicado y canonicalización. Ahí no se describe ninguna sanción por contenido duplicado.

Preguntas frecuentes

¿Se penaliza mi web si un texto aparece dos veces?

En el sentido habitual, no. El propio Google habla de filtrado, no de sanción: de varias direcciones iguales o parecidas se elige una y se muestra, las demás quedan relegadas. El perjuicio surge más bien de forma indirecta, por la dispersión del prestigio y el desperdicio de capacidad de rastreo.

¿Basta con poner la etiqueta canonical para resolver el problema?

En la mayoría de los casos sí, porque le indica al buscador qué dirección debe prevalecer. Pero es una indicación, no una orden — con enlaces internos contradictorios o redirecciones que faltan, Google puede elegir de todos modos otra dirección.

¿Falta un término? Escríbanoslo

Le explicamos cada término con calma y sin jerga técnica — y le decimos con honestidad qué tiene sentido para usted y qué no.

ProvenExpert